KEN’S CAT LOG

Vijesti o AI-ju za generiranje slika i videa — 2026-09-08

Na zatvorenoj strani, nova kategorija u kojoj LLM agenti (GPT-6 Astra), umjesto difuzijskih modela, upravljaju GUI alatima i Blenderom kako bi stvarali slike i 3D videozapise, neovisno je postala tema na Redditu, X-u i Blueskyju. Aktivnost otvorenog koda bila je koncentrirana u Lemmyjevoj ComfyUI zajednici i na YouTube kanalima za testiranje, dok je na Blueskyju, Pinterestu, Redditu i X-u gotovo nije bilo moguće uočiti.

Vijesti o AI-ju za generiranje slika i videa — 2026-09-08

Najizraženiji nalaz istraživanja na šest platformi jest neovisna popularizacija nove kategorije na trima platformama: LLM agenti, poput GPT-6 Astre, izravno upravljaju GUI alatima i Blenderom za stvaranje slika i 3D videozapisa, umjesto da se oslanjaju na difuzijske modele. Otvoreni kod ukupno je bio slabije vidljiv, ali je zajednica !stable_diffusion na Lemmyju tijekom istog tjedna uzastopno objavila pet do šest ComfyUI čvorova za ubrzavanje video-modela MiniMax H3, dok se na YouTubeu kontinuirano testira utrka između Flux.2/Flux 2 Klein i Qwen-Imagea. Pinterest i većina objava na Redditu i X-u bili su usmjereni na zatvorene proizvode poput Midjourneyja, Sore, Vea, Runwaya, Klinga, Nano Banane i Seedreama; nazivi projekata otvorenog koda gotovo se nisu pojavljivali. Na Redditu i Pinterestu također su se isticale rasprave o tome je li sadržaj uopće generiran AI-jem te o društvenim učincima AI agenata koji preuzimaju ljudske uloge i zadatke.

Na svim platformama

  • Agentsko vizualno stvaranje GPT-6 Astre neovisno je postalo tema na trima platformama: Reddit je zasebno obradio slučaj u kojem Astra upravlja Blenderom i renderira sadržaj (r/DefendingAIArt), kao i Bluesky (@simonwillison.net). Demonstracije izrade 3D gradova Astrom pokrenule su lanac imitacija na X-u (@synabreu, @GulatiYajat). Najveća zajednička tema nije bila evolucija difuzijskih modela, nego činjenica da LLM agenti preuzimaju postojeće alate kako bi crtali i stvarali 3D sadržaj.
  • Ocjene o dosljednosti likova i scena u generiranju videa i dalje su podijeljene: Na Redditu (r/generativeAI, r/aivideomaking) i X-u istodobno se objavljuju pohvale Seedanceu 2.5 (@atlas_remake) i kritike raspadanja složenih scena (@Aiden_Tech_Ai).
  • Vidljivost otvorenog koda snažno se razlikuje po platformama: Lemmyjev !stable_diffusion vrlo je aktivan s ComfyUI čvorovima za MiniMax H3, uključujući ComfyUI-Ref2VA-VSA, a na YouTubeu kontinuirano izlaze usporedbe Qwen-Imagea, FLUX-a i Wana 2.2. Nasuprot tome, na Blueskyju, Pinterestu, Redditu i X-u gotovo nije bilo objava s nazivima otvorenih modela poput novih verzija Stable Diffusiona, FLUX-a, Wana ili HunyuanVideaa. Ostaje strukturna slabost: nije jasno je li otvoreni kod doista nezanimljiv ili je izostao zbog upita usmjerenih prema zatvorenim proizvodima.
  • Rasprave o autentičnosti i društvenim posljedicama odvijaju se usporedno s tehnološkim trendovima: Na više platformi pojavile su se objave o razlikovanju stvarnog i generiranog sadržaja — Redditovi sporovi u r/isthisAI i oko Thor snimke, Blueskyjev automatski označivač aimod.social, lažni politički video u izborima za guvernera države New York te Pinterest sličice s oznakom “FAKE”. Fokus je često više na prepoznavanju i sumnji nego na samom stvaranju.

Po platformama

Reddit je među 12 niti imao veći angažman u zajednicama za rasprave o AI-ju i procjenu autentičnosti (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars) nego u specijaliziranim zajednicama za generiranje slika i videa. Zbog jednog jedinog upita gotovo nije bilo moguće usporediti zatvoreni i otvoreni kod.

X se prvenstveno vrtio oko objave NVIDIA-e o Sol-H3, video-inferenciji bržoj od reprodukcije u stvarnom vremenu, njezine lokalne reprodukcije te lanca imitacija 3D gradova izrađenih GPT-6 Astrom. Samo je manji dio 40 prikupljenih objava bio izravno relevantan, jer su se u rezultatima pojavili lokalni trendovi iz Explorea.

YouTube zbog JavaScript renderiranja nije omogućio dohvat pregleda ni broja pretplatnika, ali su potvrđeni kanali za usporedbe i objašnjenja zatvorenih proizvoda (Midjourney V8.2, Grok Imagine, Google Gemini “Omni”) i otvorenog koda (Qwen-Image-2.0, FLUX, Wan 2.2). Među šest platformi bio je najpogodniji za usporedbu zatvorenog i otvorenog pristupa.

Bluesky je zahtijevao pojedinačnu provjeru poznatih računa poput @simonwillison.net i @404media.co, jer je API za pretragu app.bsky.feed.searchPosts stalno vraćao 403. Zato cilj analize 20 objava nije dosegnut; jedina konkretna objava o otvorenom kodu bila je lokalna upotreba Qwena 3.7 27B.

Lemmy je imao najviše izvornih informacija o otvorenom kodu među svih šest platformi: uz raspravu o navodnom zaokretu Midjourneyja prema medicinskim ultrazvučnim skenerima, istaknule su se serije ComfyUI čvorova za MiniMax H3 i benchmark natjecanje Qwen-Image-Bench s modelima LLaDA-Image i Boogu-Image-0.1.

Pinterest je potvrdio 30 od unaprijed prikupljenih 50 pinova, ali zbog jednog nerazvrstanog upita većinu su činile infografike s usporedbama zatvorenih proizvoda i vodiči. Nije pronađen ni jedan naziv modela ili projekta otvorenog koda, a bez datuma i metrike angažmana nije bilo moguće procijeniti svježinu sadržaja.

Što pratiti

  • Video-inferencija MiniMax H3 / Sol-H3 brža od stvarnog vremena i proliferacija ComfyUI optimizacijskih čvorova — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA i drugi). Pratiti koliko će otvoreni utezi sustići cloud objave.
  • Širenje agentskog vizualnog generiranja GPT-6 Astrom — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Pratiti opseg daljnjih imitacija.
  • Borba za vodstvo otvorenog koda: FLUX.2/Flux 2 Klein protiv Qwen-Imagea — YouTube (SECourses, Urban Decoders). Pratiti kako će rezultati više od 700 testova utjecati na usvajanje.
  • Nastavak priče o Midjourneyjevu navodnom zaokretu prema medicinskim uređajima, Midjourney Medicalu — Lemmy (putem pivot-to-ai.com). Pratiti hoće li ostati šala ili će se provesti.
  • Posljedice zloupotrebe AI videa u političkom oglašavanju na izborima za guvernera države New York — Bluesky (404media.co). Pratiti regulativu i reakcije platformi.
  • Napredak u rješavanju dosljednosti likova i scena u generiranju videa — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Pratiti približavaju li se sveobuhvatni alati stvarnom rješenju.

Preporuke

  • Nastaviti pratiti agentsko vizualno stvaranje GPT-6 Astrom — upravljanje Blenderom i stvaranje 3D gradova — kao zasebnu temu.
  • U sljedećem ciklusu dodati upite s vlastitim nazivima, poput “FLUX”, “Stable Diffusion”, “Qwen-Image”, “Wan” i “ComfyUI”, kako objave otvorenog koda ne bi bile propuštene.
  • Za Bluesky unaprijed proširiti popis računa za praćenje, uz pretpostavku da će API za pretragu i dalje vraćati 403.
  • Pinterest koristiti za dugoročno praćenje prepoznatljivosti alata, a ne za usporedbu svježih vijesti, jer datumi i angažman nisu dostupni.
  • Izbjegavati kategorične tvrdnje o Midjourneyjevu navodnom zaokretu prema medicinskim uređajima dok se ne pojavi primarni izvor, odnosno službena objava Midjourneyja.
  • Lemmyjev !stable_diffusion i YouTube kanale za testiranje prioritetno provjeravati pri praćenju otvorenog koda.

Kvaliteta podataka

Bluesky je bio najsiromašniji izvor zbog stalnog odgovora 403 API-ja za pretragu i nedosezanja cilja od 20 objava. Pinterest nije sadržavao datume ni metrike angažmana u manifestu, pa svježinu nije bilo moguće odrediti. Reddit i X oslanjali su se na jedan upit, zbog čega nisu namjerno prikupljali objave pogodne za jasnu usporedbu zatvorenog i otvorenog koda. Posljedično se aktivnost otvorenog koda koncentrirala na Lemmy i YouTube. Na YouTubeu se zbog JavaScript renderiranja nisu mogli dohvatiti pregledi ni brojevi pretplatnika.

Sažetak po platformama

Reddit

Reddit — vijesti o AI-ju za generiranje slika i videa

Glavna mjesta rasprave (subredditi)

Prikupljenih 12 niti dolazi iz 12 različitih subreddita, po jedna nit iz svakoga. Specijaliziranih zajednica za slike i video generirane AI-jem bilo je malo; dominirali su subredditi za provjeru filmova i lažnih sadržaja te rasprave o AI kulturi.

Subreddit Broj članova Broj prikupljenih niti
r/whenthe 813,975 1
r/isthisAI 406,607 1
r/antiai 317,903 1
r/aiwars 167,158 1
r/generativeAI 151,385 1
r/RemoteWorkers 75,332 1
r/DefendingAIArt 72,770 1
r/pj_explained 96,256 1
r/NewRockstars 15,523 1
r/freetoolsAI 7,887 1
r/aivideomaking 6,517 1
r/GoogleFlow 1,789 1

Jedini upit bio je “Image and Video Generation AI News”. Zato su rezultati bili više usmjereni na rasprave za i protiv AI-ja te provjere “je li ovo AI?” nego na specijalizirane zajednice poput r/generativeAI, r/aivideomaking, r/GoogleFlow i r/freetoolsAI.

Reakcije zajednice
  • GPT-6 “ručno crta” ilustracije upravljanjem mišem, a može lažirati i time-lapse (nit 2, r/antiai, 7.013 bodova i 1.009 komentara, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Objavu zabrinjava to što LLM-u GPT-6 može biti omogućeno upravljanje mišem i tipkovnicom u digitalnom programu za crtanje te izrada uvjerljivog dokaza u obliku time-lapse snimke.
  • GPT-6 “Astra” stvara fotorealistični render u Blenderu (nit 9, r/DefendingAIArt, 143 boda i 13 komentara, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Tema nije bila da je AI izravno generirao video, nego da je agent upravljao Blenderom i izradio render.
  • Proširenje AutoFlow za Google Flow podržava kontinuirano generiranje videa (nit 12, r/GoogleFlow, 12 bodova i 6 komentara, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Funkcija “Continue from Last Frame” automatski prenosi posljednji kadar prethodnog isječka u prvi kadar sljedećeg.
  • Velika potražnja za oglasom “besplatnog AI alata za generiranje slika” (nit 3, r/freetoolsAI, 39 bodova i 48 komentara, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Dio komentatora pozdravlja besplatnu i neograničenu uslugu bez registracije, a drugi propituju troškove njezina održavanja.
  • Dugi videozapisi i dosljednost likova ostaju najveća prepreka (nit 10, r/generativeAI, 4 boda i 15 komentara, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/)). Zajednica procjenjuje da stvaranje višeminutnih znanstveno-fantastičnih videa zahtijeva kombiniranje kadrova i alata te znatan budžet.
  • Besplatno generiranje videa na laganom hardveru i dalje je nerealno (nit 8, r/aivideomaking, 6 bodova i 15 komentara, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/)). Za 45 sekundi besplatnog videa samo na telefonu i iPadu očekivanja su ocijenjena nerealnima.
  • AI slike hrane u oglasima i dalje se kritiziraju kao neukusne (nit 4, r/aiwars, 4 boda i 177 komentara, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/)). Rasprava se vodila o kvaliteti generiranih oglasa za hranu i granicama poboljšanja putem promptova.
  • Mnoštvo reakcija na oglas za rad od kuće u procjeni AI opisa slika (nit 5, r/RemoteWorkers, 152 boda i 739 komentara, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/)). Posao za 30 USD po satu uključuje provjeru pogrešaka u AI generiranim opisima.
  • Dvije rasprave o tome je li vrlo uvjerljiv AI video stvaran (niti 1/6, r/NewRockstars i r/pj_explained, ista objava proširena u više zajednica, 2026-09-02). Za navodnu snimku Thora koji udara u stup mišljenja su podijeljena između CGI-ja i AI-ja.
  • Komentari su podijeljeni oko snimke vala koji se pojavljuje kroz prozor (nit 7, r/isthisAI, 0 bodova i 79 komentara, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/)). Jedni je smatraju snimkom uživo s pogrešno shvaćenom perspektivom, drugi generiranim sadržajem zbog nefizičkog kretanja pjene.
Signali
  • Što raste: oprez prema sadržaju koji više ne izgleda kao AI. Velik odaziv na nit 2 pokazuje zabrinutost da LLM može upravljati GUI alatima i lažirati čak i dokaz “ručno nacrtanog” sadržaja.
  • Što se odbacuje: očekivanja da se besplatno i bez snažnog hardvera stvaraju dugi videozapisi visoke kvalitete. Ograničenja cijene i hardvera ostaju stroga.
  • Iznenađenje: više interesa i angažmana imaju zajednice za provjeru autentičnosti i sukobe oko AI-ja nego specijalizirani subredditi za generiranje sadržaja.
  • Suprotni signali: procjene istog materijala kao AI-ja ili ne-AI-ja često su potpuno suprotne, što pokazuje koliko je vizualna procjena običnih korisnika postala nepouzdana.
Ograničenja
  • Korišten je samo upit “Image and Video Generation AI News”, bez pretraga poput “Stable Diffusion”, “Midjourney”, “Sora”, “Kling” ili “open-source image generation”.
  • Dvanaest prikupljenih niti dolazi iz dvanaest različitih subreddita, pa nije bilo dublje usporedbe više niti unutar iste zajednice.
  • Niti 9 i 11 nemaju tekst objave, već samo naslov i komentare.
  • Niti 1 i 6 praktično su ista objava prenesena u različite zajednice, pa je stvarni uzorak bliži 11 jedinstvenih niti.
  • Tijekom ovog prikupljanja nije provedeno dodatno pretraživanje Reddita ni potpuno otvaranje svih komentara.

X

X — vijesti o AI-ju za generiranje slika i videa

Računi

Od 40 objava, njih 37 dolazi s različitih računa. Većina su jednokratne viralne ili nezapažene objave; @yu_ichi_suzuki jedini je relevantan račun s više tehničkih objava.

Račun Broj objava Trend
@yu_ichi_suzuki(鈴木憂一) 2 Tehnička nit o pokretanju MiniMaxa H3 lokalno na RTX-u 5090, ukupno 309 lajkova
@xieenze_jr(Enze Xie) 1 Objava istraživača MiniMaxa o novom modelu, 349 lajkova i oko 85.000 pregleda
@voxelphotonics 1 Viralni demo volumetrijskog prikaza Duke Nukema 3D, 6.097 lajkova i oko 297.000 pregleda
@synabreu 1 3D model Seula izrađen GPT-6 Astrom, 2.700 lajkova i oko 235.000 pregleda
@GulatiYajat(Yajat Gulati) 1 3D grad Gurgaon izrađen GPT-6 Astrom, 574 lajkova
@luccacerf 1 Demo kombinacije Blender MCP + Astra + Tripo, 445 lajkova
@He1s_Sammy 1 Nit o poslovanju s AI videozapisima za djecu bez pojavljivanja pred kamerom, 388 lajkova
@SD_Tutorial(Stable Diffusion Tutorials) 1 Tehničko objašnjenje Sol-H3, uz manji odaziv od 22 lajka
@Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox po 1 Manji računi koji raspravljaju o kvaliteti i ograničenjima Seedancea 2.5 i AI videa
Objave
  1. MiniMax predstavlja Sol-H3, generiranje videa brže od reprodukcije u stvarnom vremenu (#2 @xieenze_jr, 349 lajkova, 62 reposta, 23 odgovora i oko 85.000 pregleda, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). Na osam NVIDIA B300 Blackwell GPU-ova model generira pet sekundi videa rezolucije 1344×768 za 1,653 sekunde.
  2. Tehničko objašnjenje iste objave brzo se proširilo (#3 @SD_Tutorial, 22 lajka i oko 2.100 pregleda, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). Objavu povezuje sa stranicama Sol-Engine/Sol-H3 NVIDIA Researcha.
  3. Objavljen postupak za lokalno pokretanje MiniMaxa H3 na RTX-u 5090 (#4–5 @yu_ichi_suzuki, 295+14 lajkova, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Lokalni tijek rada kombinira Alibaba distilirani LoRA i RTX Video Super Resolution za povećanje rezolucije.
  4. Fashion video generiran Seedanceom 2.5 (#1 @Strength04_X, 68 lajkova, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Objavljen je 30-sekundni fotorealistični kinematografski video s potpunim promptom.
  5. Seedance 2.5 generira svijet nalik Toy Storyju (#14 @atlas_remake, 3 lajka, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Objavu posebno impresionira rad s više animiranih likova i objekata.
  6. Kritika da su AI videozapisi još uvijek “automat za igre na sreću” (#12 @Aiden_Tech_Ai, 1 lajk, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). Naglašava probleme s više prostora, pokretom kamere, blokiranjem likova i kontinuitetom.
  7. Duke Nukem 3D prikazan na volumetrijskom 3D zaslonu (#10 @voxelphotonics, 6.097 lajkova, 921 repost i oko 297.000 pregleda, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Nije izravno generativni AI, ali je bio jedan od najvećih viralnih događaja u promatranom razdoblju.
  8. Cijeli Seoul pretvoren je u 3D grad pomoću GPT-6 Astre (#20 @synabreu, 2.700 lajkova, 451 repost i oko 235.000 pregleda, 2026-09-06, https://x.com/synabreu/status/2096557555086725159).
  9. Gurgaon je na sličan način izrađen GPT-6 Astrom (#22 @GulatiYajat, 574 lajkova, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). Izravni primjer imitacije trenda nakon što je autor vidio druge Astra demonstracije.
  10. Demo kombinacije Blender MCP + Astra + Tripo (#21 @luccacerf, 445 lajkova, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). Primjer povezivanja više AI alata putem MCP-a.
  11. AI videozapisi za djecu bez pojavljivanja pred kamerom postaju sadržajni biznis (#23 @He1s_Sammy, 388 lajkova, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056).
Signali
  • Što raste: izrada 3D svjetova kroz razgovor s agentom, posebno 3D gradovi GPT-6 Astrom i integracije s Blender MCP-om.
  • Što također raste: Sol-H3 inferencija brža od stvarnog vremena i paralelni pokušaji lokalnog korištenja otvorenih utega.
  • Što se podcjenjuje ili dijeli mišljenja: dosljednost više likova i prostora; u istom razdoblju postoje i pohvale i snažne kritike.
  • Iznenađenje: samo su tri od devet trendova Explorea bila izravno relevantna; šest ih je bilo lokalno ili tematski nepovezano. Ipak je pretraga trenda “Building” slučajno otkrila kvalitetne Astra demonstracije.
  • Slučaj VTuberice Veibae: pretraga trenda o njezinu povratku uz animaciju farme suncokreta nije pronašla relevantne objave same autorice ni dokaz uporabe AI-ja u toj animaciji.
Ograničenja
  • Trend o VTuberici Veibae nije omogućio potvrdu veze s AI generiranjem slika ili videa.
  • Većina prikupljenih objava bila je nepovezana s temom zbog regionalnih trendova.
  • Nisu korišteni ciljani upiti poput “Stable Diffusion”, “Midjourney”, “Sora”, “Kling” ili “ComfyUI”.
  • Explore je bio geografski vezan uz lokaciju poslužitelja, vjerojatno područje Hrvatske, i ne predstavlja globalne trendove na X-u.
  • Prikupljanje je završeno na 40 objava bez dodatnog otvaranja odgovora, oznaka ili drugih objava istih računa.

YouTube

YouTube — najnoviji trendovi AI-ja za generiranje slika i videa

Kanali
  • 動画編集の中の人 (kanal) — brojne usporedbe praktične uporabe AI-ja za slike.
  • AI大学【AI&ChatGPT最新情報】 (kanal) — mjesečni pregledi generativnih AI alata.
  • 【さき】のAIでええやん。 (kanal) — objašnjenja Google I/O-a i Gemini ažuriranja.
  • Qwen(službeno) (kanal) — službene najave serije Qwen-Image.
  • AIOnTrend (kanal) — usporedbe otvorenih slikovnih modela.
  • Urban Decoders (kanal) — objašnjenja arhitekture Flux modela.
  • SECourses (kanal) — opsežna lokalna testiranja generiranja slika.
  • Woollyfern (kanal) — redovno praćenje Midjourney ažuriranja.
  • 寺田部チャンネル (kanal) — praktične recenzije lokalnog generiranja videa kroz ComfyUI.
  • 東京大学 吉田幸 研究室 (kanal) — redovita akademska objašnjenja trendova generativnog AI-ja.

Broj pretplatnika nije bilo moguće dohvatiti jer se YouTubeovi rezultati pretrage i stranice videa renderiraju JavaScriptom.

Videozapisi
Zatvoreni kod
  1. 【ド課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — praktična usporedba Nano Banana Proa, Seedreama 4.0, Midjourneyja i Adobe Fireflyja.
  2. 【2026年冬最新】ここ数か月で過去イチ進化した無料の人気動画生成AIツール6選!~Sora 2、Veo 3.1、Kling 2.6など~ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — šest besplatno dostupnih alata, uključujući Soru 2, Veo 3.1 i Kling 2.6.
  3. 【性能ランキング世界1位】xAIの動画生成AI「Grok Imagine」徹底解説! Sora/Veo級の映像を無料で作る方法! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — objašnjenje Grok Imaginea i tvrdnje o besplatnoj izradi sadržaja klase Sora/Veo.
  4. 【最新】GoogleのAI Geminiのモデルが大幅アップデート!動画生成Omniも発表されたGoogle I/O 2026を解説するで! — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — pregled Gemini ažuriranja i novog video-modela Omni predstavljenog na Google I/O 2026.
  5. Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — pregled izdanja Midjourney V8.2, personalizacije i NIJI Style Creatora.
Otvoreni kod
  1. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — službeni Qwen kanal — https://www.youtube.com/watch?v=1tM7Wd0lEeI — službena najava Qwen-Image-2.0.
  2. Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — testiranje na više od 700 slučajeva i objava preseta.
  3. Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — usporedba otvorenih Flux 2 Kleina, Qwena i Z Image Turba sa zatvorenim Nano Banana Proom.
  4. Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — arhitektura Flux.2 i usporedba s Nano Banana Proom.
  5. Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed!https://www.youtube.com/watch?v=JXgBe3twxbc — najava lakog lokalno pokretljivog modela Flux 2 Klein.
  6. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Modelshttps://www.youtube.com/watch?v=3BFDcO2Ysu4 — vodič kroz Wan 2.2, FLUX i Qwen Image.
  7. 【無料・ComfyUI】ローカル動画生成AIを使って長編動画を制作するのは簡単か?無茶苦茶大変です — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — praktično izvješće o stvaranju dugog videa lokalnim AI-jem i ComfyUI-jem.
Signali
  • Kod zatvorenih proizvoda ključno pitanje je odnos cijene i brzine nasuprot kvaliteti.
  • Midjourney nastavlja brzi mjesečni ritam poboljšanja serije V8.
  • Google I/O 2026 i Gemini video-generiranje Omni tretiraju se kao zasebna velika vijest.
  • Otvoreni kod vodi borbu za primat između Qwen Imagea i FLUX-a.
  • Flux 2 Klein zasebno se ističe kao lagan model usmjeren na lokalno pokretanje.
  • Wan i Qwen Image zajedno predstavljaju Alibaba-inu otvorenu sliku i video strategiju.
  • Lokalno generiranje dugih videa kroz ComfyUI i dalje je operativno vrlo zahtjevno.
Ograničenja
  • YouTubeove stranice rezultatâ i videa renderiraju se JavaScriptom, pa se iz statičkog HTML-a nisu mogli pročitati videozapisi, pregledi, datumi, opisi ni komentari.
  • Provjera se stoga oslanjala na site:youtube.com pretrage i YouTubeov oembed endpoint.
  • U ovim metodama nisu bili dostupni pregledi, pretplatnici, cijeli opisi ni komentari.
  • Nisu pronađene posebne, svježe vijesti o generiranju slika ili videa za razdoblje od 1. do 8. rujna.

Bluesky

Bluesky — vijesti o AI-ju za generiranje slika i videa

Računi
Ručka Vrsta Pratitelji i ostalo Bilješka
@simonwillison.net pojedinac, poznati AI tehnički bloger i autor Datasettea Uspoređuje modele vlastitim testom crtanja pelikana na biciklu. Najbogatiji izvor sadržaja u ovom prikupljanju.
@404media.co medij Povremeno objavljuje ekskluzivne priče vezane uz AI-generirane medije.
@aimod.social upravljanje zajednicom 2.555 pratitelja, 94 objave Automatski označivač slika za koje se sumnja da su generirane AI-jem.
@stablediffusion.bsky.social pojedinac Objave su stale u siječnju 2025.
@bm63ai.bsky.social pojedinac AI-art objave uglavnom su prestale; zadnja objava iz 2026. odnosi se na aplikaciju izrađenu vibecodingom.
@petapixel.bsky.social fotografski medij Kritički prati Adobeove generativne značajke, ali nema novijih relevantnih objava.
Objave
  • Povratak benchmarka pelikana na biciklu s GPT-6 Astrom (@simonwillison.net, 2026-09-04, 202 lajkova, 9 reposta i 18 odgovora, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Uspoređeni su GPT-6 Astra, GPT-5.6 Sol, Terra i Luna kroz SVG ilustracije.
  • GPT-6 Astra upravlja Blenderom i stvara 3D scenu s pelikanom (@simonwillison.net, 2026-09-05, 400 lajkova i 30 reposta, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Agent je kroz tri koraka dobio zadatak otvoriti instalirani Blender, renderirati scenu i značajno je poboljšati.
  • Otvoreni Qwen 3.7 27B lokalno crta pelikana (@simonwillison.net, 2026-08-14, 183 lajka i 14 reposta, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). Model je pokrenut kao 17 GB GGUF u LM Studiju na MacBooku Pro M5 Max.
  • Kandidat za guvernera New Yorka napada suparnike AI-generiranim lažnim videom (@404media.co, 2026-09-02, 124 lajka, 22 reposta i 7 odgovora, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). Primjer zloupotrebe video-generiranja u političkom oglašavanju.
  • Producent Cocomelona nalaže umjetnicima AI eksperimente (@404media.co, 2026-09-06, 84 lajka, 23 reposta i 21 odgovor, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). Moonbug Entertainment navodi da će koristiti AI, uz čovjeka u procesu.
  • Označivač sumnjivih AI slika aimod.social ima više od 2.500 pratitelja (istraživanje profila, https://bsky.app/profile/aimod.social). Postoje pravila označivanja i postupak žalbe.
  • Stariji računi za AI umjetnost uglavnom su utihnuli (@stablediffusion.bsky.social, @bm63ai.bsky.social). Aktivnost se zamjetno premjestila iz stvaranja prema označivanju i sumnji u sadržaj.
  • Kritike Adobeovih generativnih funkcija iz prethodnog ciklusa (@petapixel.bsky.social, 2025-02-12 i 2025-01-09). Referentni primjer kritičkog odnosa prema komercijalnim alatima, izvan trenutnog ciklusa vijesti.
Signali
  • Što raste: vizualni zadaci GPT-6 Astre, uključujući SVG ilustracije i 3D renderiranje u Blenderu, tema su na Redditu i Blueskyju.
  • Što je slabo vidljivo: otvoreni kod; osim lokalnog Qwena 3.7 27B nisu pronađene konkretne objave o FLUX-u, novim verzijama Stable Diffusiona, Wanu ni HunyuanVideu.
  • Iznenađenje: ranije aktivni računi za AI umjetnost utihnuli su, dok se aimod.social održava i raste kao infrastruktura za označivanje sumnjivih slika.
  • Suprotni signali: vidljivost video-generiranja više dolazi iz političke zloupotrebe nego iz natjecanja samih modela.
Ograničenja
  • Javni Bluesky API za pretragu app.bsky.feed.searchPosts vraćao je HTTP 403 za sve upite.
  • Web sučelje za pretragu je klijentski renderirana SPA aplikacija, pa se tekst objava nije mogao pročitati iz HTML-a.
  • Istraživanje je zato bilo ograničeno na pojedinačne feedove poznatih računa i nije zamjena za potpunu pretragu po ključnim riječima.
  • Nisu pronađeni ili nisu imali relevantne objave očekivani računi OpenAI-ja, Google DeepMinda, Midjourneyja, Runwaya, Stability AI-ja, Black Forest Labsa, Kree i većih tehnoloških medija.
  • Cilj od otprilike 20 analiziranih objava nije dosegnut; analizirano je osam relevantnih objava i jedna referentna starija objava.

Lemmy

Lemmy — vijesti o AI-ju za generiranje slika i videa

Lemmy je mnogo manja, federirana društvena mreža od Reddita, pa “viralnost” ovdje znači desetke, a ne stotine glasova. Ipak su prikupljene guste informacije, prvenstveno iz !«メールアドレス», !ai_reddit, !technology i !techtakes.

Zajednice
  • !«メールアドレス» — 5.709 pretplatnika, od čega 893 lokalna. Središte za ComfyUI prilagođene čvorove i objave modela.
  • !«メールアドレス» — 2.362 pretplatnika. Galerija radova izrađenih Stable Diffusionom, Fluxom i Krea2.
  • !«メールアドレス» — zajednica za anime AI umjetnost, s visokom aktivnošću.
  • !«メールアドレス» — 87.904 pretplatnika. Repostovi većih tehnoloških članaka.
  • !«メールアドレス» — 2.690 pretplatnika. Satirična zajednica o AI industriji.
  • !«メールアドレス» — RSS prijenos vijesti iz r/ArtificialIntelligence.
  • !«メールアドレス» — 8.154 pretplatnika. Antiai zajednica koja prati kritike AI opskrbnih lanaca.
Objave
Više usmjereno na zatvoreni kod
  1. Midjourney navodno mijenja smjer prema medicinskom ultrazvučnom skeneru “Midjourney Medical” — 2026-06-18–19, !techtakes i !hackernews, rezultat 40–58. https://lemmy.world/post/48384985
  2. Midjourney traži od holivudskih studija da otkriju kako koriste AI — TechCrunch, !technology, rezultat 73. https://lemmy.world/post/49069400
  3. Google izdaje Nano Banana 2 Lite — lagani model za generiranje slika. https://lemmy.world/post/48857780
  4. Microsoftov MAI-Image-2.5 sustiže Nano Banana 2 na benchmarkovima!ai_reddit, 2026-05-28. https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/
  5. Detaljna usporedna recenzija ByteDance Seedreama 5.0 Pro!ai_reddit, 2026-07-10. https://www.reddit.com/gallery/1usc03q
  6. Googleova Earth AI funkcija ugašena je dan nakon izlaska zbog zloupotrebe lažnih slika stvarnih lokacija. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
  7. Runwayjev poslovni segment udvostručio se uz NRR veći od 300%!ai_reddit, 2026-08-30. https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/
  8. Amnesty International kritizira vodeće AI sustave kao nezakonite već po dizajnu!ai_reddit, 2026-06-24. https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
  9. Pax Silica: militarizacija AI opskrbnih lanaca!fuck_ai, rezultat 14, 2026-09-06. https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
  10. Pokušaj da “Astra 6 max” stvori umjetnost koja će oduševiti autora!ai_reddit, 2026-09-05. https://i.redd.it/3h241pocalnh1.png
Više usmjereno na otvoreni kod
  1. Objavljen LLaDA-Image — novi model s Diffusion Transformerom od 6B parametara i zamrznutim modulom za vizualno-jezično razumijevanje; rezultat 53,53 na engleskom i 53,38 na kineskom u Qwen-Image-Benchu. Objavljeni su utezi, kod za treniranje i recepti. https://lemmy.dbzer0.com/post/74988021
  2. Izdanje Boogu-Image-0.1 — Base, Turbo i Edit varijante pod licencom Apache-2.0, 10B parametara i rezultat 53,58 na Qwen-Image-Benchu. https://boogu.org/
  3. ComfyUI-Ref2VA-VSA: čvor za ubrzavanje inferencije za MiniMax H3!stable_diffusion, 2026-09-08. https://github.com/Kablex/ComfyUI-Ref2VA-VSA
  4. ComfyUI-AetherScale: NVIDIA-native povećivač rezolucije za video!stable_diffusion, 2026-09-05. https://github.com/vizart-vj/ComfyUI-AetherScale
  5. ComfyUI-VDN-H3: hibridna pažnja Video Delta Net — čvor za učinkovitije video-modele. https://github.com/Saganaki22/ComfyUI-VDN-H3
  6. ComfyUI-Majoor-OmniCam: raspored kamere i alat za animaciju — čvor za upravljanje radom kamere. https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
  7. FastH3-Ref2V-Stream-Controller — alat za upravljanje streamingom u MiniMax H3 video-generiranju. https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
  8. ComfyUI-InpaintCanvas: sučelje za inpainting nalik Kriti!stable_diffusion, 2026-09-08. https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
  9. ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — tri uzastopno objavljena čvora za ubrzavanje i olakšavanje MiniMax H3 modela, 2026-09-01–02. https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
  10. InterleaveThinker — istraživanje pojačanog učenja za agentsko izmjenično stvaranje teksta i slike. https://arxiv.org/abs/2606.13679
  11. Kontinuirani niz radova izrađenih Flux/Krea2 turbo modelima — zajednice !stable_diffusion_art i !share_anime_art svakodnevno objavljuju nekoliko radova. https://lemmy.dbzer0.com/post/75150630
Signali
  • 🔥 Najveća tema je Midjourneyjeva navodna dezorijentacija. Priča o medicinskom ultrazvuku izazvala je velik interes, pretežno negativan i satiričan.
  • 🛠️ Za MiniMax H3 isti je tjedan objavljeno pet do šest ComfyUI čvorova. To je tipičan znak da se razvojna zajednica masovno natječe u optimizaciji jedne video-osnove.
  • 📊 Qwen-Image-Bench postaje zajednički pokazatelj usporedbe. LLaDA-Image i Boogu-Image-0.1 izravno se natječu rezultatima na istom benchmarku.
  • 😤 Generativni AI prodire i izvan tehničkih zajednica, uključujući geopolitičke i antiai rasprave o opskrbnim lancima.
  • 🤖 Zbog manjeg uzorka, Lemmyjeve rezultate treba tumačiti relativno, a ne uspoređivati apsolutne brojke s Redditom ili X-om.
Ograničenja
  • Lemmy je federiran, a pretraga se razlikuje po instancama. Pretraga je uglavnom ograničena na API lemmy.world.
  • Upiti za Kling AI, Stability AI, Wan 2.2 i Runway Gen nisu dali relevantne rezultate.
  • !ai_reddit je automatski prijenos Reddita, a ne Lemmyjev izvorni primarni izvor.
  • Iako je analizirano oko 20 objava, ukupan broj objava na Lemmyju znatno je manji nego na Redditu i X-u.

Pinterest

Pinterest — vijesti o AI-ju za generiranje slika i videa

Od 50 unaprijed prikupljenih pinova (output/pinterest.pins.md / images/pinterest/manifest.json) pregledano je 30 slika. Rezultati se temelje na tom pregledu.

Vizualne teme
  • Clickbait sličice za “AI vijesti”: česti su izrazi iznenađenja, neonski logotipi alata, eksplozivne pozadine i umjetni voditelji vijesti; većina vodi na YouTube, a ne na primarne članke.
  • Infografike “najboljih” zatvorenih proizvoda: često se ponavljaju Runway, Pika, Kling AI, Luma, Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora i Google Veo.
  • AI roboti i voditelji kao metafora: roboti za stolom s vijestima, sintetizirane voditeljice te medicinske scene s robotima naglašavaju zamjenu ljudskih uloga.
  • Strah od deepfakea i autentičnosti: oznake “FAKE”, kvizovi “Which is AI?” i alati za detekciju AI sadržaja čine zaseban dio uzorka.
  • Generičke stock AI ilustracije: ljubičasto-plavi neon, obrisi mozga, sklopovi i čestice često služe samo kao dekorativna pozadina.
  • Demonstracije image-to-video transformacija: prikazi jedne slike ili videa pretvorenih u Lego, origami, cvjetni stil ili druge varijante.
  • Nazivi proizvoda su gotovo potpuno zatvorenog koda: Veo 2/3, VASA-1, Grok, Sora, ChatGPT i Nano Banana pojavljuju se često, bez potvrđenih naziva otvorenih modela ili repozitorija.
  • Infografike AI pipelinea: jedan pin prikazuje automatizirani tok “Scout→Script→Generate→Animate” za izradu vloga iz viralne poveznice.
Značajni pinovi
  • [1] Image to Video AI: How It Works and Why It Matters — konkretan dijagram stvaranja video-vremenske crte iz jedne slike, uz kontrole jačine pokreta i vremenske dosljednosti.
  • [7] (bez naslova, mreža LEGO/origami/cvijeće) — usporedni prikaz pretvorbi izvornog videa u više stilova.
  • [9] 10 FREE AI VIDEO TOOLS IN 2026 — popis deset besplatnih alata, uključujući Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canvu i Hyperwrite.
  • [24] (bez naslova, ljubičasti lik u image-to-video primjeru) — tri izlazna videa iste slike u potpuno različitim okruženjima; povezan s Veo 3.
  • [27] 5+ Best AI Video Generation Websites — usporedba Runwaya, Pike, Kling AI-ja, Lume, Canve i Hailoa za Shorts, TikTok, Pinterest video-pinove i produktne videozapise.
  • [36] Top AI Image Generation Tools — ChatGPT, Nano Banana, GenTube, Ideogram i Z-Image.
  • [39] The Latest AI Developments — jedini pin s konkretnim vijestima: AI prva odgovara na pozive 911 u New Orleansu, Meta objavljuje offline agentski model Muse Glimmer, a Kimsuky automatizira phishing dokumente vlastitim AI stackom.
  • [41] Microsoft Unveils VASA-1 — tehnički demo animacije govornih lica iz jedne slike i audiozapisa.
  • [16] AI Image Video: Best Quality vs Best Free — vodič za odabir plaćenih alata visoke kvalitete i besplatnih alternativa.
  • [47] AI video creation just got crazy — prijedlog automatiziranog četveroagentskog procesa za izradu vloga.
Signali
  • Pinterestov sadržaj o generiranju slika i videa prvenstveno su SEO i affiliate infografike s usporedbama alata i vodičima, a ne brze vijesti ili primarni izvori.
  • Samo je ograničen broj pinova imao konkretne vijesti; većina je upućivala na proizvode i promotivni sadržaj.
  • Zatvoreni proizvodi snažno dominiraju; u pregledanih pinova nije pronađen nijedan prepoznatljiv projekt otvorenog koda.
  • Motivi zamjene ljudskih uloga AI-jem i sumnje u autentičnost sadržaja pojavljuju se usporedno.
  • Uporaba videa naglašava animiranje fotografija i preobrazbu postojećih videa više nego stvaranje text-to-video sadržaja od nule.
Ograničenja
  • Pedeset pinova prikupljeno je jednim, nerazvrstanim upitom bez zasebne pretrage zatvorenog i otvorenog koda.
  • Pregledano je samo 30 od 50 slika; neprovjereni indeksi su 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45, 48 i drugi.
  • Pinterest nije izravno pregledavan; analiza se oslanja na unaprijed prikupljene slike i naslove.
  • Manifest ne sadrži datume ni metrike angažmana, pa nije moguće procijeniti svježinu ni doseg.
  • Pinterest nije dovoljan izvor za zaključke o otvorenom kodu.

Preporučene radnje

  • Nastaviti pratiti agentsko vizualno stvaranje GPT-6 Astrom, uključujući upravljanje Blenderom i izradu 3D gradova.
  • Na svim platformama dodati pretrage naziva “FLUX”, “Stable Diffusion”, “Qwen-Image”, “Wan” i “ComfyUI”.
  • Proširiti unaprijed definirani popis Bluesky računa za praćenje zbog očekivanog nastavka problema s API-jem za pretragu.
  • Pinterest ograničiti na praćenje prepoznatljivosti alata, a ne koristiti ga za usporedbu svježih vijesti.
  • Ne iznositi definitivne tvrdnje o Midjourney Medicalu prije službene objave Midjourneyja.
  • Lemmyjev !stable_diffusion i YouTube kanale za testiranje koristiti kao prioritetne izvore za otvoreni kod.

Prikupljene slike

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoThe Ultimate AI Image and Video Generation Platform - The Data Scientist️ Image to Video AI – Animate Your Photos With AIGoogle announces ultra-high quality video...Just Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!imageAI News: OpenAI Finally Released What We Asked ForVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesimageArtificial intelligence: let’s maintain our...AI For Image And video GenerationTop 10 Lip Sync Tools (2026) – Best AI Lip Sync Software for Realistic Lip Sync VideoTop AI Video Generators of 2025GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSimageHow AI Is Transforming Video EditingWhy AI Video Generation Is Becoming Essential for...More than 20% of YouTube is now AI-generatedGoogle announces video generation AI 'Veo 3',...‎🚨 AI is getting scary good.image5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026imageArtificial Intelligence: A Tool to Free the...AI driven image and video analysisDiscover how Grok is revolutionizing video...12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MorePaul Lafargue of the IDEC Group: The impact of...How To Detect AI-Generated Images Online For Freeimage generation Ai tools 🔥🔥What is Imagvio AI and how it helps creators...TotalYmage revolutionizes interactive videos...The Latest AI Developments - AI Picks Up 911 Line Meta Offline Modelai toolsMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationFuture of Video Creation: Best AI Video Generators of 2026🔸AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥The Snarky AI News RoundUp #8I will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoLe guide ultime pour exploiter Chat GPT en tant...AI Video Creating just got crazy.What Is Generative AI? Complete Technical Guide - RCN GuideHow To Create A News Channel With AI || AI News Video Generator || AI Lip SyncAi

Napomena o kvaliteti podataka

Bluesky nije dosegnuo cilj od 20 objava jer je API za pretragu stalno vraćao 403. Pinterest nije omogućio dohvat datuma ni angažmana, pa svježina nije bila mjerljiva. Reddit i X, zbog jednog upita, nisu sustavno uspoređivali zatvoreni i otvoreni kod, zbog čega su se teme otvorenog koda koncentrirale na Lemmy i YouTube.

Galerija