Vijesti o AI-ju za generiranje slika i videa — 2026-09-05
GPT-6 „Astra” ovaj je tjedan dominirao zanimanjem za zatvorene modele na X-u i Blueskyju, dok su video/slikovni modeli otvorenog koda (LTX-2.5, MiniMax H3, Qwen-Image-3.0) držali korak gotovo u potpunosti unutar ekosustava ComfyUI-ja, a najveća pojedinačna priča bila je prelazak Midjourneyja s generiranja slika na medicinsku ultrazvučnu opremu.
Pregled vijesti o AI-ju za generiranje slika i videa ~ zatvoreni nasuprot otvorenim modelima ~ — 2026-09-05
Bok! Svijet AI-ja za generiranje slika i videa ovaj je tjedan bio totalni kaoswww🔥 Na strani zatvorenih modela OpenAI-jev GPT-6 „Astra” potpuno je preuzeo pozornost, uz više od 100 milijuna pregleda na X-u (bivšem Twitteru)😳 S druge strane, otvoreni kod nije zaostajao: moćni modeli poput LTX-2.5, MiniMax H3 i Qwen-Image-3.0 izlazili su jedan za drugim s otvorenim težinama, a ComfyUI se učvrstio kao prava matična platforma🛠️ Pomalo zastrašujuća vijest bila je da je Midjourney navodno odustao od generiranja slika i preusmjerio se na tvrtku za medicinske ultrazvučne skenere😱 To je stvarno bilo šokantno. Još jedno otkriće: korisnike Reddita više je pogodila rasprava o „pravnom statusu AI-generiranih sadržaja” nego sam tehnološki napredak!
Kroz platforme
- Festival GPT-6 Astra: odmah je postao tema i na X-u i na Blueskyju (benchmark slika pelikana Simona Willisona). X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . Zanimljivo je da se Astra ne prodaje kao AI za generiranje slika/videa, ali je svi testiraju za 3D modeliranje i animaciju😂
- ComfyUI je de facto baza otvorenog koda: na YouTubeu i Lemmyju Wan, FLUX, Qwen-Image, LTX-2.5, MiniMax H3 i Trellis.2 gotovo se uvijek spominju zajedno s ComfyUI-jem. YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- Problem MiniMaxa H3: „otvoren je, ali se komercijalna uporaba naplaćuje”: tema i na Lemmyju (video model koji radi čak i na RTX 3060, ali za Comfy je potrebna plaćena licenca) https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。Granica između otvorenog i zatvorenog stvarno postaje mutna🤔
- Kontroverze i zaokreti rastu bolje od tehnologije: isti se obrazac vidio na Redditu (više od 800 komentara o sudskoj odluci o AI-generiranom CSAM-u) https://www.reddit.com/r/news/comments/1w5k6pr/ i Lemmyju (Midjourneyjev zaokret prema medicinskim uređajima, score 58–73) https://lemmy.zip/post/66397234 .
Platformu po platformu
Reddit: mjesečni pregled na r/StableDiffusionu (velik broj izdanja otvorenih modela poput Qwen3.8, DeepSeek-V4-Pro, Ling-3.0 i Gemma-4-31B, tempom koji ni komentari ne mogu pratiti) izvrstan je thread https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ . Pozornost je privukao i World Labsov Atlas, tehnologija koja trenutačno stvara 3D svjetove iz videa/fotografija i može imati primjenu u robotici https://www.reddit.com/r/accelerate/comments/1w5ye9s/ . No najviše je odjeknula ne tehnička vijest, nego thread o presudi da je „AI-generirana dječja pornografija ustavno zaštićena”; čini se da pravne i etičke teme na Redditu stvaraju veću raspravu.
X: pretraga se svela na četiri objave o Astri, pa je GPT-6 Astra imao pozornicu samo za sebe🎤 Najtehničkija je bila objava developera @Dimillian, koji je demonstrirao 3D radni tok „od Blendera do UE5” https://x.com/Dimillian/status/2095596700815516004 . U ovom rasponu pretrage nije pronađena ni jedna objava o otvorenom kodu (Stable Diffusion, Flux, Wan i slično), što je velika rupa u podacima.
YouTube: zatvoreni modeli pokriveni su brojnim usporednim recenzijama, uključujući Nano Banana 2, Kling 3.0 nasuprot Veo3.1 i Sora2 te Seedance2.5 i Seedream5.0 Pro https://www.youtube.com/watch?v=AAD7wJ3DWiA . Otvoreni modeli uključuju LTX-2.5 (iznimno brz model koji stvara deset sekundi videa u 720p za 6,8 sekundi) https://www.youtube.com/watch?v=RjlbDhs1MPk i HunyuanImage3.0 (MoE s 80B parametara) https://www.youtube.com/watch?v=U-8RjjU7x14 . Otvorene težine već se uspoređuju sa zatvorenim konkurentima odmah nakon predstavljanja. Pojavila se i priča da OpenAI gasi Sora API i koncentrira resurse na idući model „Spud” (sam YouTube video nije potvrđen, informacija dolazi preko vijesti).
Bluesky: redoviti „benchmark slike pelikana” Simona Willisona postao je stalna točka za provjeru kvalitete zatvorenih modela https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . Službeni račun Replicatea djeluje kao centar brzih objava za video modele kao što su Kling3.0, Seedance2.0, Runway Gen-4.5 i Vidu Q3 https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c . Gotovo da nema primarnih objava o otvorenom kodu; čak je i ostris, autor LoRA alata, rekao da je „AI/ML zajednica uglavnom ostala na X-u (Twitteru)”😅 Japanski sadržaj uglavnom se svodi na dijeljenje GIGAZINE-ova članka o Qwen-Image-3.0 https://gigazine.net/news/20260722-qwen-image-3/ .
Lemmy: !«メールアドレス» ima najveću gustoću informacija o otvorenom kodu. Gotovo polovica objava odnosila se na MiniMax H3 (Comfy kao komercijalni reseller https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller , alati koji rade s 16 GB VRAM-a i sl.). Zanimljiv je i LLaDA-Image, s potpuno objavljenim receptom za treniranje https://arxiv.org/abs/2609.03796 . Kod zatvorenih modela, vijest o Midjourneyjevu prijelazu s generiranja slika na medicinske ultrazvučne skenere imala je daleko veći score (58–73) od novih modela i bila glavna tema zajednice.
Pinterest: vizualno su zatvoreni modeli uvjerljivo dominantni — Google Veo2/3, Microsoft VASA-1, Grok4.6 i Gemini s milijardom korisnika česti su motivi sažetih grafika. Od posebnih imena otvorenog koda jedva se vidi išta osim AMD-ova lokalnog alata „Amuse 3.0”. Vrlo su česti slučajevi uporabe koji „pokreću ili stvaraju lica” — sinkronizacija usana, reprodukcija izraza i izrada portreta — vjerojatno zato što se dobro podudaraju s Pinterestovom publikom zainteresiranom za ljepotu i sadržaj za društvene mreže.
Što pratiti
- Nastavak priče o GPT-6 Astri usmjerenoj na slike/video — X, https://x.com/flowith/status/2095750768204877858(najava usporedbe animacije GPT-6 Astra i GPT-5.6, uskoro)
- Gašenje Sora API-ja → idući model „Spud” — prema YouTube istraživanju, API bi trebao biti ugašen 2026-09-24. Nitko još nije potvrdio stvarne snimke ni funkcije.
- Razvoj komercijalnog licenciranja MiniMaxa H3 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (hoće li se ustaliti hibridni pristup: otvorene težine, ali plaćena komercijalna uporaba)
- Midjourneyjev zaokret prema medicinskim uređajima — Lemmy, https://lemmy.zip/post/66397234 (napušta li etablirani zatvoreni igrač ozbiljno AI generiranje slika)
- Potpuno otvoreni recept za treniranje LLaDA-Imagea — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (u kojoj će se mjeri ubuduće kopirati otvoreni model s vrhom Qwen-Image-Bencha)
- Atlas World Labsa — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (kako će se generiranje 3D svjetova iz videa prenijeti na podatke za treniranje robota)
Preporuke
- X bi trebalo ponovno pretražiti ne oslanjajući se na trendove, nego koristeći konkretne oznake poput „Stable Diffusion”, „ComfyUI”, „Flux”, „Wan”, „Kling” i „Sora”.
- Budući da Blueskyjev API
searchPostsnije radio zbog 403 odgovora, za sljedeći put bi bilo učinkovitije unaprijed proširiti popis poznatih računa putem Google pretrage. - Modele poput MiniMaxa H3, koji imaju otvorene težine ali se komercijalno koriste uz naknadu, u izvješću treba označiti napomenom umjesto da ih se jednostavno svrstava u „otvorene”.
- Vijesti o povlačenju ili zaokretu velikih igrača, poput Midjourneyjeva zaokreta i gašenja Sore, zaslužuju trajnu kategoriju praćenja jer čitateljima privlače više pažnje od tehničkih vijesti.
- Budući da Pinterest ima malo primarnih informacija, bolje ga je koristiti kao termometar percepcije općih korisnika nego kao izvor za praćenje tehničkih trendova.
- Trend s Reddita i Lemmyja — da sudske odluke i etičke kontroverze stvaraju više buke od tehničkih vijesti — vrijedi izdvojiti kao zaseban signal i u sljedećim sažecima.
Kvaliteta podataka
- X: prikupljene objave potjecale su iz trendova vezanih uz hrvatsku regiju, pa su osim četiri objave o GPT-6 Astri predstavljale nepovezan šum (kriptovalute, Elonova zajednica, sport itd.). Nije bilo ni jednog spomena otvorenog koda, pa nije ostvaren cilj od 20 analiziranih objava.
- Bluesky: službeni API za pretraživanje vraćao je 403, pa je pristup promijenjen na provjeru pojedinačnih feedova poznatih računa. Pronađeno je tek oko 12 izravno relevantnih objava, uz gotovo nikakve primarne informacije o otvorenom kodu.
- Reddit: uz samo jedan upit prikupljeno je 12 threadova iz devet subreddita, manje od ciljanih 20. Ipak, zabilježeno je najviše šest vodećih komentara po threadu.
- YouTube: zbog JavaScript prikaza stranica rezultata i videa nije bilo moguće izravno potvrditi broj pregleda, pretplatnika ni točan datum objave; datumi su procijenjeni iz relativnih oznaka u isječcima.
- Lemmy: zbog federirane prirode mreže pretraga jedne instance propušta objave s drugih instanci. Izravne pretrage zatvorenih video servisa (Sora, Kling, Veo i slično) gotovo da nisu dale rezultate.
- Pinterest: od 50 stavki otvorene su i stvarno provjerene samo 24 slike; za ostale su bili dostupni samo naslovi. Podaci ne sadrže metrike angažmana poput lajkova i spremanja.
Sažetak po platformama
Reddit — Vijesti o AI-ju za generiranje slika i videa
Gdje
Prikupljenih 12 threadova dolazi iz devet subreddita. Korišten je samo upit „Image and Video Generation AI News”.
| Subreddit | Broj pretplatnika | Broj prikupljenih threadova |
|---|---|---|
| r/generativeAI | 150,575 | 4 |
| r/GrokAiDiscussion | 4,883 | 1 |
| r/freetoolsAI | 7,616 | 1 |
| r/StableDiffusion | 1,000,814 | 1 |
| r/accelerate | 77,800 | 1 |
| r/news | 31,531,475 | 1 |
| r/antiai | 313,317 | 1 |
| r/allthequestions | 127,064 | 1 |
| r/teenagers | 3,673,210 | 1 |
r/generativeAI ima najviše objava (četiri) i središte je opuštenih objava o traženju i usporedbi alata. Drugdje je pronađena po jedna objava; osobito je primjetno da se tema prelila i u subreddite koji nisu specijalizirani za generiranje slika/videa, poput r/newsa i r/teenagersa.
Što ljudi govore
- #4 r/StableDiffusion „Local AI News You Missed - August 2026” (201pt · 22 komentara · 2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — mjesečni pregled navodi velik broj izdanja otvorenih modela tijekom kolovoza, uključujući Qwen3.8, DeepSeek-V4-Pro-0813, seriju Ling-3.0 i Gemma-4-31B. Dodatne prijave u komentarima pristizale su jedna za drugom: u/Narutobirama(20) navodi Qwen3.8 Flash Next, a u/MoJaKF(14) Anima-3.8B 1.1, što pokazuje tempo koji čak ni pregledna objava ne može pratiti.
- #5 r/accelerate „…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground” (763pt · 76 komentara · 2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — World Labsov Atlas stvara interaktivne 3D svjetove iz videa/fotografija. Reakcije poput u/stainless_steelcat(48), „Matrix bullet time comes to real life...now I know it wasn't ambitious enough.”, bile su oduševljene, uz raspravu o mogućoj primjeni video generiranja za podatke za treniranje robota.
- #6 r/generativeAI „Same prompt. Same 30 seconds. Two different AI video models.” (98pt · 30 komentara · 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — usporedba Seedancea 2.5 i Wana 3.0 s istim promptom. u/SpecialistDragonfly9(5) smatra da je „seedance is the by FAR superior one”, dok u/Positive-Key6640(4) dovodi u pitanje samu metodologiju: „Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better”.
- #2 r/GrokAiDiscussion „Have they loosened the image to video generation moderation” (14pt · 28 komentara · 2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — iskustva korisnika s pravilima moderiranja Grok Imaginea su podijeljena. u/Miserable_Appeal515(2) kaže „it has gotten better”, dok u/joderrelldalejr(2) odgovara: „Hell no it gets worse and then they start to limit how many images you can even do in a week”.
- #1 r/generativeAI „List of daily AI video generative websites” (38pt · 27 komentara · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — razmjena savjeta za korisnike koji maksimalno koriste besplatne kvote. Kling AI navodno ima „66 free credits every 24 hours”, u/Murky-Race-3443(1) navodi da CapCut daje dnevne besplatne kredite, a u/Julia_Leeds94(1) predstavlja YalleryLabs, gdje petosekundni video u 720p počinje od $0.18 uz budžet od $3.
- #3 r/freetoolsAI „Free AI Image Generator” (31pt · 31 komentar · 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — promotivna objava za generator slika bez registracije prikupila je komentare; u/Odd-Lingonberry1516(2) navodi alternative Deepany, Aifun i Perchance. u/thecragmire(1) pita: „How do you maintain this? It's got to cost you something, right?”
- #11 r/generativeAI „GOOD image-to-video ??” (1pt · 13 komentara · 2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI opisan je kao „practically king of the hill for realistic human motion”, a Runway kao „The gold standard for creative control”; za lokalni rad u/Ok-Addition1264(2) preporučuje ComfyUI + WAN22/LTX2.3.
- #7 r/generativeAI „Any good Ai video site ? Even if it paid ?” (0pt · 15 komentara · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) ocjenjuje Runwayjev gen-3 kao alat koji „actually handles motion pretty well compared to a lot of the jank”, dok je Pika „fun for quick little loops...but the output gets samey after a while”.
- #8/#10 r/news „Federal Judge rules AI generated child sex abuse material is protected by First Amendment.” (1,379pt · 545 komentara · 2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) i r/allthequestions „Why did a federal judge declare the creation of AI generated child porn as legal?” (31pt · 277 komentara · 2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — rasprava o pravnom statusu AI-generiranog sadržaja skupila je izniman angažman. u/Ntroepy(414) upozorava da je naslov obmanjujući i vezan uz presudu Vrhovnog suda iz 2002., dok u/TheGracefulCrane(31) objašnjava: „judges dont make laws and the law hasnt been updated to make it illegal ergo the ruling”.
- #9 r/antiai „AI generated images are becoming harder to detect” (113pt · 30 komentara · 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — unatoč naslovu, komentari su se uglavnom šalili na račun pogrešno generiranih udova, primjerice u/GurInside278(31): „why are her feet her hands”.
- #12 r/teenagers „To all AI image/video generator users” (7pt · 41 komentar · 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — objava koja osporava tvrdnju da „AI umjetnost ne zahtijeva rad umjetnika”. Komentari poput u/LiterallyGarbage_0(5), „people who use ai to make "art" genuinely make me so upset...pick up a pencil”, pokazuju snažno anti-AI raspoloženje među tinejdžerima.
Signali
- Rast: učestalost izdanja lokalnih otvorenih modela za LLM-ove, slike i video raste toliko brzo da je ni komentare threada #4 teško pratiti. Novi smjer uzbuđenja čine i primjene poput Atlasova (#5), gdje video generiranje služi za podatke u robotici.
- Sukob mišljenja: izvješća o moderiranju Grok Imaginea (#2) potpuno su podijeljena između „bolje je” i „gore je”. Kod Seedancea nasuprot Wanu (#6) uz tvrdnje da Seedance uvjerljivo pobjeđuje stoji prigovor da usporedba s istim promptom sama po sebi nema veliku vrijednost.
- Podcijenjeno / dovedeno u pitanje: standardni format usporedbe modela s istim promptom (#6) u/Positive-Key6640 kritizira kao metodologiju.
- Iznenađenje: thread #9, naslovljen kao da će govoriti o težem prepoznavanju AI slika, zapravo se pretvorio u šale o pogrešno generiranim udovima. Usto, pravne odluke (#8 i #10, ukupno više od 800 komentara) ostvarile su daleko veći angažman od produktnih vijesti: na Redditu su pravna i etička pitanja AI sadržaja veći izvor sukoba od tehnološkog napretka.
Ograničenja
- Upotrijebljen je samo jedan upit, „Image and Video Generation AI News”, pa je prikupljeno 12 threadova iz devet subreddita, manje od otprilike 20 objava po mreži koje zahtijeva brief.md.
- U ovoj se fazi samo čitalo unaprijed prikupljene datoteke
output/reddit.threads.md/.threads.json; nisu se izvodile dodatne pretrage ni izravno pristupalo pojedinačnim threadovima ili komentarima, prema uputama playbooka. Mogući propusti najvjerojatnije su izvan dosega tog jednog upita. - Za svaki thread zabilježeno je najviše šest vodećih komentara, pa reakcije niže na listi i manjinska mišljenja nisu uvršteni.
X
X — Vijesti o AI-ju za generiranje slika i videa
Računi
Od 34 računa u ovoj zbirci, samo su četiri objavila nešto povezano s AI-jem za generiranje slika/videa — svi o istom lansiranju, unutar ista 24 sata (2026-09-03):
- @OpenAI (OpenAI) — jedna objava, ali ona je cijela priča: 309,095 lajkova,
55,587 repostova, ~108,000,000 pregleda. Račun je učinio minimum (jedan
najavni tweet sa slikom), a ostalo je napravio volumen. - @MatthewBerman (Matthew Berman) — račun AI influencera, jedna objava
(4,054 lajkova, ~1,500,000 pregleda), oblikovana kao thread s prvim dojmovima
uz „rani pristup”, čime se pozicionira kao tester, a ne izvor. - @Dimillian (Thomas Ricouard) — jedna objava (7,199 lajkova, ~2,300,000 pregleda),
developer pokazuje konkretan radni tok (Blender → Unreal Engine 5), umjesto
općeg hypea — najkonkretnija tehnička tvrdnja u skupu. - @flowith (Flowith) — najmanji račun ovdje (947 lajkova, ~115,000 pregleda),
produktni račun koji koristi lansiranje za usporedbu s prethodnim modelom.
Svi drugi računi u zbirci (ukupno 34 računa i 40 objava) — računi za kripto/memeove (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), fan računi Elona/Tesle (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), influencer za kibernetičku sigurnost (@corewarrior, @hackerzspace), poljski/afrički/bosanski računi s vijestima i memeovima, fan računi Ariane Grande (@vodolove je objavio 3 od 4 stavke), te računi nagradnih igara pivskih brendova (@naturallight, @ChinookCi) — nemaju veze s AI-jem za generiranje slika ili videa. Navedeni su samo zato što ih je zbirka stvarno vratila; pogledajte Ograničenja.
Objave
1. Lansiranje GPT-6 „Astra” — @OpenAI
- 309,095 lajkova · 55,587 repostova · 7,713 odgovora · ~108,000,000 pregleda · 2026-09-03
- https://x.com/OpenAI/status/2095595741528125780
„Ovo je GPT-6 Astra. Sve što možete napraviti na računalu, Astra može napraviti za vas. Brzo.”
Najveća pojedinačna objava u cijelom prikupljenom skupu, za red veličine. Predstavljena je kao opći agent za rad na računalu, a ne kao model posebno za slike/video — no demonstracije drugih računa u nastavku sve su vizualne ili 3D, što sugerira da su Astrine demonstrirane prednosti upravo na toj strani.
2. Astra nasuprot prethodnom modelu, u okviru animacije — @flowith
- 947 lajkova · 69 repostova · 19 odgovora · ~115,000 pregleda · 2026-09-04
- https://x.com/flowith/status/2095750768204877858
„GPT-6 Astra VS GPT-5.6 u animaciji uskoro na flowith.io”
Račun proizvoda treće strane izričito najavljuje usporedbu Astre i prethodne generacije u animaciji — konkretan signal da se Astra testira i promovira upravo za sposobnosti generiranja animacije, a ne samo za opći rad na računalu.
3. Thread s ranim pristupom — @MatthewBerman
- 4,054 lajkova · 494 repostova · 210 odgovora · ~1,500,000 pregleda · 2026-09-03
- https://x.com/MatthewBerman/status/2095595892464333065
„Astra (GPT-6) je stigla!!! Imao sam rani pristup i ludo je testirao na igrama, kodu, pisanju, kontroli preglednika, prezentacijama i općem znanju. Ovo je najbolji model koji sam ikad koristio. Točka.”
Primjetno je ono što ne spominje: generiranje slika ili videa nije izrijekom navedeno na popisu mogućnosti, iako thread najavljuje „nevjerojatne demonstracije ispod”.
4. Prikaz rada od Blendera do Unreal Enginea 5 — @Dimillian
- 7,199 lajkova · 1,145 repostova · 259 odgovora · ~2,300,000 pregleda · 2026-09-03
- https://x.com/Dimillian/status/2095596700815516004
„Astra je vrlo dobra u 3D modeliranju i jedva čekam da to svi iskusite. Za sada, evo kratkog prikaza kako sam izradio demo kuću za našu objavu o lansiranju: od Blender scene do iskustva za šetnju u Unreal Engineu 5.”
Najkonkretnija tvrdnja vezana uz specifične alate u zbirci: Astra se koristi u stvarnom 3D produkcijskom toku (Blender → UE5), što je bliže radu s videom/vizualima od bilo čega drugog što je X pokazao u ovom krugu.
Signali
- Rast: GPT-6 „Astra” jedina je priča povezana sa slikama/videom koju je ova zbirka pronašla i uvjerljivo dominira angažmanom (~108 milijuna pregleda samo za najavnu objavu nasuprot nekoliko stotina tisuća za ostalo). Skup reakcija unutar 24 sata — usporedba proizvoda, influencerovi prvi dojmovi i developerova 3D demonstracija — djeluje kao koordinirano lansiranje, a ne organsko otkrivanje.
- Odsutno / zanemareno: nijedan model otvorenog koda za generiranje slika ili videa (Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI itd.) ne pojavljuje se nigdje u ovoj zbirci. Ako se takav rad trenutačno odvija na X-u, ovaj ga krug pretrage nije dosegnuo.
- Iznenađenje: koliko malo diskursa o lansiranju „AI-ja” zapravo navodi generiranje slika ili videa kao funkciju — popis Matthew Bermana to potpuno izostavlja, a Astra se reklamira kao opći agent („sve što možete na računalu”). Aspekt slika/videa zaključuje se iz onoga što su rani testeri odlučili demonstrirati (3D modeliranje, usporedba animacija), a ne iz OpenAI-jeva vlastitog uokviravanja.
Ograničenja
- Prikupljene pretrage nisu ciljale ovu temu. Deset stvarno pretraženih izraza — „Astra”, „$SONG”, „Robinhood”, „Elon”, „#CyberSecurity”, „Poland”, „Africa”, „Bosnia”, „ariana”, „#Sweepstakes” — bili su X-ov vlastiti popis trendova u ovoj sesiji (pogledajte tablicu Explore u
x.posts.md), a ne pojmovi odabrani za AI generiranje slika/videa. Samo je pretraga „Astra” (objave #1–4) bila relevantna; ostalih 36 objava čine nepovezan šum iz pogrešno odabranog popisa. - Kriteriji dovršenosti nisu ispunjeni. Brief traži analizu oko 20 objava po platformi; ova zbirka ima samo četiri upotrebljive objave, sve o jednom zatvorenom lansiranju (GPT-6 Astra), i nula o otvorenom generiranju slika/videa. Za stvarnu pokrivenost bilo bi potrebno pretražiti pojmove poput „Stable Diffusion”, „ComfyUI”, „Flux”, „Kling AI”, „Runway”, „Sora”, „Midjourney”, „Wan 2.x” ili „HunyuanVideo”.
- Napomena o geolokaciji: X-ov popis trendova u ovoj je sesiji geolociran na Hrvatsku (većina stavki izričito je označena kao „Trending in Croatia”), zbog čega kripto tokeni, bosanski nogomet i vijesti/memeovi iz balkanske regije prevladavaju u popisu — to su trendovi jednog položaja poslužitelja, a ne globalna slika.
- Potpuni nedostatak pokrivenosti otvorenog koda. Ništa u ovoj zbirci ne dotiče vijesti, alate ni izdanja otvorenog koda za generiranje slika ili videa — taj je nedostatak potpun, a ne djelomičan.
YouTube
YouTube — Vijesti o AI-ju za generiranje slika i videa (zatvoreni / otvoreni kod)
Kanali
Kanali pronađeni putem YouTube pretrage i pretrage vijesti. Za većinu nije bilo moguće izravno potvrditi broj pretplatnika jer se video stranice prikazuju JavaScriptom (detalji u ## Ograničenja).
- Theoretically Media — poznati kanal koji Wan, FLUX, Qwen-Image i druge AI-je za generiranje otvorenog koda redovito testira u ComfyUI-ju. („Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...” https://www.youtube.com/watch?v=3BFDcO2Ysu4)
- Matt Wolfe / The Next Wave — poznati po usporedbama zatvorenih AI alata kao što su Runway, Kling, Veo i Sora.
- Više pojedinačnih AI kanala koji objavljuju recenzije modela LTX-2.5, MiniMax H3 i Nano Banana 2 (nazivi kanala nisu se pojavili u rezultatima pretrage; potvrđeni su samo naslovi videa).
Videozapisi
Zatvoreni modeli
- „Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!” — oko 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — praktični test Googleova Gemini 3.1 Flash Imagea, poznatog kao Nano Banana 2, uz tvrdnju da rješava kompromis između brzine i kvalitete slike.
- „Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To” — kraj veljače 2026. — https://www.youtube.com/watch?v=B1d3SIfoQLk — usporedba izlaza standardne i Pro verzije te procjena koju koristiti.
- „Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2” — oko 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — izravna usporedba Kuaishouova Klinga 3.0 s Veo 3.1 i Sora 2; Kling dobro prolazi u realizmu snimke i radu kamere.
- „Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)” — oko 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — plaćeni praktični test Klinga 3.0, uključujući višekadrovsku generaciju i 4K pri 60 fps.
- „Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!” — oko 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — test ByteDanceova slikovnog modela Seedream 5.0 Pro i još neobjavljenog Seedancea 2.5; navodi se da je ByteDance preskočio Seedance 2.1.
- „Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?” — oko 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — provjera tvrdnje da Seedance 2.5 može stvoriti 30 sekundi kontinuirane snimke u jednom kadru.
- „MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model” — početak kolovoza 2026. — https://www.youtube.com/watch?v=67CCQBAwZiA — praktični test MiniMaxa H3 (Hailuo 3.0), izdanog 2026-07-31, s potvrdom 2K, 15 sekundi i izvornog stereo zvuka.
- „Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)” — oko kolovoza 2026. — https://www.youtube.com/watch?v=la0iBk8g8_g — potpuni test omnimodalnih funkcija MiniMaxa H3, koje istodobno prihvaćaju tekst, sliku, video i zvuk.
- „FLUX 3 Sneak Peek” — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — najava Black Forest Labsova FLUX-a 3, multimodalnog modela za slike, video od 20 sekundi, zvuk i akcije; video funkcija postala je opće dostupna 2026-08-04.
- „Gen-4.5 Updates — Research Demo Day 2025 | Runway” — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — službeni Runwayjev pregled tehničkih nadogradnji Gen-4.5, uključujući kontrolu kamere i konzistentnost likova.
- „All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!” — nedavno — https://www.youtube.com/watch?v=SnmRpf_VfgU — video o korištenju besplatnih kvota više zatvorenih AI-jeva, uključujući Kling, Veo, Sora i Nano Banana Pro.
Otvoreni modeli
- „LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch” — sredina kolovoza 2026. (oko tri tjedna nakon javne objave otvorenih težina LTX-2.5 2026-08-11) — https://www.youtube.com/watch?v=RjlbDhs1MPk — izvorna integracija Lightricksova 22B svjetskog modela LTX-2.5 u ComfyUI i potvrda stvaranja desetosekundnog 720p videa za 6,8 sekundi.
- „LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows” — oko tri tjedna ranije — https://www.youtube.com/watch?v=WpKNXZZqQEU — izravna usporedba otvorenog LTX-2.5 sa zatvorenim MiniMaxom H3 na fizici i višekadrovskim scenama.
- „New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)” — oko tri tjedna ranije — https://www.youtube.com/watch?v=pA2BQw9LY8A — test usmjeren na brzinu lokalnog izvođenja.
- „Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — vodič kroz Wan 2.2 (MoE video model), FLUX, FLUX Krea i Qwen Image u ComfyUI-ju. Wan 2.2 ocijenjen je kao model s konzistentnošću bliskom Sori, a FLUX kao bolji u detaljima.
- „HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet” — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — predstavljanje Tencentova slikovnog MoE modela s 80B parametara; navodi se tijesna prednost u pobjedama nad Seedreamom 4.0, Nano Bananom i GPT-Imageom.
- „Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!” — oko 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — recenzija i ComfyUI postavljanje FLUX.2, uključujući verziju otvorenih težina; opisuje održavanje konzistentnosti subjekta uz do deset referentnih slika.
- „FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret” — oko 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — postupak instalacije FLUX.2 u ComfyUI i objašnjenje novih funkcija.
- „Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)” — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — prvi lokalni test Alibaba Qwen-Imagea, prethodnika kasnijeg Qwen-Image-2512.
- „Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow” — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — provjera prijenosa stila s više referentnih slika u Qwen Image Editu putem GGUF radnog toka u ComfyUI-ju.
- „MiniMax H3: The New Open-Source Video Champ?” — oko kolovoza 2026. — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3 predstavljen je kao omnimodalni video model s otvorenim težinama, uz spomen prvog mjesta na rang-listi uređivanja videa.
Signali
- Otvorene težine ubrzano se približavaju vrhu: LTX-2.5 (2026-08-11) i MiniMax H3 (2026-07-31) oba su objavljena s otvorenim težinama unutar posljednjih 60 dana; ističu se usporedne sličice koje ih uspoređuju sa zatvorenim konkurentima. Otvoreni modeli više nisu samo „sljedbenici”, nego se uspoređuju odmah nakon objave.
- ByteDanceov brzi ciklus izdanja: Seedream 5.0 Pro i Seedance 2.5, uz preskakanje verzije 2.1, ažuriraju se svakih nekoliko mjeseci, a YouTuberi objavljuju brze provjere pod naslovima poput „Tested” i „Leaks”.
- Preslagivanje Googleova portfelja: cijela Imagen linija trebala bi biti ugašena 2026-08-17, uz prijelaz na Nano Banana modele iz serije Gemini 3.x Image. Za Nano Banana 2, izdan 2026-02-26, već postoji više usporednih videa s nasljednicima, poput Pro verzije.
- Povlačenje velikog zatvorenog igrača: OpenAI planira ugasiti Sora API 2026-09-24 i računalne resurse usmjeriti na nadolazeći model „Spud” (prema rezultatima pretrage; YouTube video nije potvrđen). To je važna prekretnica za trend zatvorenih modela.
- ComfyUI je de facto baza za testiranje otvorenog koda: gotovo svi videi o otvorenim modelima, uključujući Wan, FLUX, Qwen-Image i LTX-2.5, dolaze uz postupak instalacije u ComfyUI-ju.
Ograničenja
- YouTubeove stranice rezultata (
youtube.com/results?...) i videa (youtube.com/watch?v=...) prikazuju se JavaScriptom; izravno dohvaćanje vraćalo je samo navigacijske poveznice u podnožju, pa nije bilo moguće očitati sirove podatke kao što su broj pregleda, broj pretplatnika iliytInitialData. Datumi su zato procijenjeni prema isječcima tražilice („3 weeks ago” i slično) ili navodima u člancima; za većinu videa nisu potvrđeni točan broj pregleda i broj pretplatnika kanala. - Nije pronađen izravan YouTube video o OpenAI-jevu gašenju Sore i nasljedniku „Spud”; stavka se oslanja na spominjanje u člancima, a reakcije na YouTubeu nisu potvrđene.
- Pronađene su službene objave Runwaya Gen-4.5 i Midjourneyjevih novijih ažuriranja, ali ne i nedavne nezavisne recenzije unutar zadnjih 60 dana.
- Za pojedinačne videe o Nano Banana Pro, uključujući naslov „Nano Banana Pro… wtf”, potvrđene su poveznice, ali ne i naziv kanala ni broj pregleda.
Bluesky
Bluesky — Najnoviji trendovi AI-ja za generiranje slika i videa
Računi
- Simon Willison @simonwillison.net — developer poznat po evaluaciji LLM-ova i slikovnih modela. Pri svakom izlasku novog modela objavljuje usporedbu slika kroz svoj redoviti „benchmark pelikana”. Reakcije pratitelja čine ga korisnim primarnim izvorom za vijesti o zatvorenim modelima.
- fofr @fofr.ai — autor slikovnih promptova iz Replicate kruga. Često dijeli praktične načine uporabe Nano Banana Proa (Gemini 3 Pro Image).
- Replicate (službeni) @replicate.com — službeni račun tvrtke za API hosting AI modela. Objavljuje najave kad model stigne na Replicate i služi kao brz izvor izdanja video modela, zatvorenih i otvorenih.
- Amanda Silberling (novinarka TechCruncha) @amanda.omg.lol — novinarka koja prati kulturnu stranu AI generiranja slika.
- AI News Updates @ai-latestnews.bsky.social — bot račun za automatske objave vijesti iz AI industrije.
- gigowat @gigowat.bsky.social — račun koji na Blueskyju dijeli članke japanske tehnološke stranice GIGAZINE. Jedan je od rijetkih izvora vijesti o generiranju slika na japanskom.
- ostris @ostris.com — autor alata otvorenog koda za LoRA treniranje „AI-Toolkit”. Objavljuje o modelima iz obitelji Flex, ali prema vlastitim riječima „AI/ML zajednica uglavnom je ostala na Twitteru”, pa su ažuriranja na Blueskyju rijetka.
Objave
-
Simon Willison — objavio usporednu mrežu slika pelikana iz GPT-6 Astre i GPT-5.6 Sol/Terra/Luna (zatvoreni modeli, usporedba OpenAI-jevih slikovnih modela). 2026-09-04, 👍91 · 🔁6 · 💬12.
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
U nastavku je objavio i punu veličinu generirane slike (alt tekst također je generirao GPT-5-astra). 👍23.
https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c -
Simon Willison — usporedna objava slike pelikana generirane Google Gemini 3.7 Flashom. 2026-09-02, 👍6.
https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r -
fofr — podijelio detaljan prompt za rekreiranje renderiranja u stilu retro igre uz Nano Banana Pro (Gemini 3 Pro Image). 2026-01-19, 👍31.
https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
Istoga je dana objavio i prompt za stvaranje snimke zaslona nalik Street Viewu. 👍10.
https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m -
Replicate (službeni) — objavio da je OpenAI-jev „GPT Image 2” dostupan na Replicateu. Ističe fotorealizam, preciznost ispisivanja teksta te primjenu u UI-ju i dizajnu (zatvoreni model). 2026-04-21.
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate (službeni) — objavio da je ByteDanceov video model „Seedance 2.0” otvoren svim korisnicima. Ujedinjuje tekst, sliku, video i zvuk u jednu scenu te sinkronizirano stvara stereo zvuk (zatvoreni model). 2026-04-09.
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate (službeni) — Runwayjev Gen-4.5 dodan je na Replicate; video model naglašava fizički realizam (zatvoreni model). 2026-02-18.
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate (službeni) — Kuaishouov Kling 3.0 (+o3) dodan je na Replicate; podržava višekadrovni 4K i sinkronizaciju zvuka (zatvoreni model). 2026-02-17.
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate (službeni) — video model „Vidu Q3” dodan je na Replicate. Podržava generiranje iz teksta, slike te početnog/završnog kadra, do 16 sekundi i 1080p (zatvoreni model). 2026-03-11.
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Amanda Silberling (TechCrunch) — objava kojom traži komentare stručnjaka o tome zašto AI-generirane slike hrane često imaju prepoznatljiv izgled; novinarski upit o estetskim posebnostima AI slika. 2026-08-28, 👍17 · 🔁5 · 💬4.
https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x -
AI News Updates (bot) — izvijestio da je „Midjourney Inc. kupio astrološku aplikaciju Co-Star i pokreće novu aplikaciju za generiranje slika”. 2026-07-25. Sadržaj se podudara s izvještajima TechCruncha i Bloomberga od 2026-07-24, prema kojima je preuzimanje zaključeno tog proljeća, pa ga je moguće provjeriti.
https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s -
gigowat (dijeljenje GIGAZINE-ova članka na japanskom) — podijelio članak o otvorenom AI-ju za generiranje slika „Qwen-Image-3.0”, s provjerom performansi za ilustracije i japanski tekst. 2026-07-22.
https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
(izvorni članak: https://gigazine.net/news/20260722-qwen-image-3/ ) -
ostris — objavio izdanje otvorenog slikovnog modela „Flex.2-preview”, koji objedinjuje generiranje slike iz teksta, univerzalnu kontrolu i inpainting. Objavu iz 2025-04-22 treba smatrati starijom, ali je jedan od rijetkih primjera da autor otvorenog modela izravno objavljuje na Blueskyju. 👍4.
https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a
Signali
- Prednost zatvorenih modela: objave na Blueskyju koje stvarno ostvaruju angažman koncentrirane su oko velikih zatvorenih modela — GPT-a, Geminija/Nano Banana Proa i Midjourneyja. Willisonov „benchmark pelikana” postao je praktički stalno mjesto za provjeru kvalitete zatvorenih slikovnih modela pri izlasku novih verzija.
- Replicate kao brzi centar za video modele: Kling 3.0, Seedance 2.0, Runway Gen-4.5 i Vidu Q3 redom su objavljeni preko službenog Replicate računa. Broj lajkova malen je (1–2), ali račun je koristan za praćenje vremenskog slijeda pojave modela.
- Otvoreni modeli slabo su zastupljeni na Blueskyju: gotovo da nema primarnih spomena glavnih otvorenih modela s težinama iz 2026., poput Wana 2.7, HunyuanVideoa 1.5, Chrome, LTX-2.3 i drugih. Čak i ostris navodi da je AI/ML zajednica uglavnom ostala na Twitteru, što sugerira da je težište zajednice na X-u.
- Objave na japanskom uglavnom su dijeljenja GIGAZINE-a: japanski sadržaj uglavnom se svodi na dijeljenje članaka s novinskih stranica, bez pronađenih izvornih analitičkih objava.
Ograničenja
- Službeni Blueskyjev API za pretraživanje objava (
app.bsky.feed.searchPosts) stalno je vraćao403 Forbiddenu ovoj sesiji WebFetcha, pa nije bilo moguće sustavno prikupiti objave prema ključnim riječima s brojem lajkova i repostova. Metoda je prebačena na pojedinačnu provjeru feedova poznatih računa sgetAuthorFeed;getProfile,getAuthorFeed,getPostThreadi oEmbed radili su normalno. - Sama Blueskyjeva stranica za pretraživanje,
bsky.app, SPA je koja se prikazuje JavaScriptom, pa WebFetchov pretvarač HTML-a u Markdown nije mogao dohvatiti tekst objava. - Zbog navedenih ograničenja nije bilo moguće iscrpno provjeriti sve objave prema određenim nazivima modela; umjesto toga izdvojene su relevantne objave iz nedavnih feedova poznatih računa. Provjereno je nešto više od 20 objava/feedova, ali je samo oko 12 pronađenih objava bilo izravno povezano s generiranjem slika/videa.
- Za glavne otvorene modele s težinama (Wan, HunyuanVideo, Chroma, sam Z-Image, LTX-2.3 i slično) na Blueskyju nisu pronađene relevantne objave iz 2026. Probani su brojni računi; huggingface.bsky.social imao je prazan feed, a civitai-bot.bsky.social nije ažuriran od svibnja 2024.
- Pronađena je osobna objava iz veljače 2026. koja tvrdi da je Midjourney postao dio Meta.ai-ja, ali je vanjska provjera pokazala da je riječ o licencnom ugovoru iz kolovoza 2025., pri čemu je Midjourney ostao neovisan. Zbog netočnosti nije uključena u izvješće.
Lemmy
Lemmy — Najnoviji trendovi AI-ja za generiranje slika i videa (zatvoreni / otvoreni modeli)
Zajednice
- !«メールアドレス» — 5,708 članova. Tehničke rasprave o AI-ju otvorenih težina za generiranje slika i videa. Zajednica s najvećom gustoćom relevantnih informacija u ovom istraživanju.
- !«メールアドレス» — 2,360 članova. Mjesto za radove stvorene modelima iz obitelji Stable Diffusion; malo je samih vijesti.
- !«メールアドレス» — 1,593 člana. Namijenjena anime AI umjetnosti, s malo vijesti.
- !«メールアドレス» — 50 članova. Automatski RSS prijenosi s Reddita; treba imati na umu da se ne radi o ljudskoj raspravi.
- !«メールアドレス» i !«メールアドレス» — opće tehnološke vijesti. Malo je zasebnih objava o generiranju slika/videa; tema se gubi među člancima o AI-ju općenito.
- Na Lemmyju ne postoji velika zajednica specijalizirana za AI generiranje slika/videa, usporediva s r/StableDiffusionom na Redditu; rasprava je raspršena među manjim zajednicama navedenima iznad.
Objave
Otvoreni modeli
- MiniMax H3: Comfy postaje službeni reseller komercijalnih licenci — !«メールアドレス», score 4, 2026-08-28. Izvorni članak: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3 je video model s otvorenim težinama objavljen u kolovozu 2026.; lokalno radi i na GPU-ovima klase RTX 3060 te generira 2K video s izvornim stereo zvukom. Comfy je postao prodajni posrednik za komercijalne licence (Professional/Enterprise), a Enterprise omogućuje uporabu i nedestiliranog modela.
- LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス», score 2, 2026-09-04. https://arxiv.org/abs/2609.03796 。Slikovni model s potpuno otvorenim receptom za treniranje, vrhunskim rezultatom na Qwen-Image-Benchu i brzom destiliranom turbo verzijom.
- Trellis.2 i Pixal3D izvorno integrirani u ComfyUI — !«メールアドレス», score 4, 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。Najavljeno je da su „najbolji otvoreni modeli za 3D generiranje” postali dio jezgre ComfyUI-ja.
- ComfyUI-MiniMaxH3-CLSS — !«メールアドレス», score 0, 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。Alat za MiniMax H3 koji omogućuje generiranje videa proizvoljne duljine sa zvukom i na potrošačkim računalima sa 16 GB VRAM-a.
- Fizgig LoRA/LoKR Studio — !«メールアドレス», score 4, 2026-08-30. https://github.com/shootthesound/Fizgig 。Otvoreni alat za treniranje i izdvajanje LoRA/LoKR adaptera za više obitelji modela, uključujući Krea 2, MiniMax i Klein 9B.
- VibeVoice-ComfyUI (Microsoftov otvoreni TTS integriran u ComfyUI) — !«メールアドレス», score 1, 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。Primjer uključivanja zvuka u radne tokove generiranja videa.
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», score 5, 2026-06-17. Lagani otvoreni temeljni slikovni model usmjeren na učinkovitost.
Zatvoreni modeli
- Midjourney se preusmjerava s AI generiranja slika na medicinske ultrazvučne skenere — !«メールアドレス», score 58, 2026-06-18. https://lemmy.zip/post/66397234 。Brojni povezani threadovi, uključujući Hacker News mirror s scoreom 40+, potaknuli su veliku raspravu pod nazivima „Midjourney Medical” i „Ultrasonic CT”. To je jedna od najvećih vijesti o zaokretu etablirane zatvorene usluge za slike.
- Midjourney od holivudskih studija zahtijeva detaljno otkrivanje uporabe AI-ja — !«メールアドレス», score 73, 2026-07-05. https://lemmy.today/post/56011946
- Izdan je Googleov novi slikovni model „Nano Banana 2 Lite” — !«メールアドレス», score 0, 2026-07-02. https://lemmy.world/post/48936394(hackernews mirror: https://lemmy.bestiver.se/post/1199483 )
- Microsoftov MAI-Image-2.5 približio se Googleovu Nano Banana 2 na benchmarkovima — !«メールアドレス», score 1, 2026-05-28. https://lemmy.durstig.online/post/35068
- Praktična usporedna recenzija Seedreama 5.0 Pro — !«メールアドレス», score 1, 2026-07-10. https://lemmy.durstig.online/post/46063
- Runway objavio da se poslovanje s poduzećima udvostručilo, uz neto zadržavanje prihoda iznad 300% — !«メールアドレス», score 0, 2026-08-30. https://lemmy.durstig.online/post/56937
- Googleova funkcija Earth AI tiho povučena dan nakon objave zbog problema s NSFW generiranjem — !«メールアドレス», score 1, 2026-08-07. https://lemmy.durstig.online/post/52162
Signali
- Strana otvorenog koda puna je MiniMaxa H3: gotovo polovica objava zajednice stable_diffusion krajem kolovoza i početkom rujna 2026. odnosi se na proširenja ComfyUI-ja i alate za MiniMax H3: lokalni video, rad na RTX 3060 klasi i zvuk. Model se doima kao da postaje de facto standard za otvoreno generiranje videa.
- Granica između otvorenog i zatvorenog postaje mutna: MiniMax H3 ima otvorene težine, ali se komercijalna uporaba naplaćuje licencama preko Comfyja. Model „besplatno za uporabu, ali plaćeno za komercijalne svrhe” znak je hibridnog pristupa koji može postati uobičajen.
- Najveća vijest zatvorenih modela je „povlačenje”: vijest da Midjourney prelazi s generiranja slika na medicinske uređaje, tj. da se jedan od velikih zatvorenih igrača preusmjerava na potpuno drugo poslovanje, dobila je daleko viši score (58–73) od utrke novih modela.
- 3D generiranje ulazi u ComfyUI: otvoreni modeli za pretvaranje teksta/slike u 3D, poput Trellisa.2 i Pixal3D-a, postaju dio jezgre ComfyUI-ja. Lokalni radni tokovi sada obuhvaćaju ne samo slike i video, već i stvaranje 3D resursa.
- Lemmy u cjelini nema veliku specijaliziranu zajednicu za AI generiranje slika/videa: razgovori su raštrkani između tehnički orijentiranih Stable Diffusion zajednica s nekoliko tisuća članova i malih bot zajednica poput ai_reddita s 50 članova.
Ograničenja
- Lemmy je federirana mreža, a API za pretraživanje obično obuhvaća samo indeks jedne instance: API pretraga
lemmy.worldpropušta objave drugih instanci poputlemmy.dbzer0.comilemmy.today. U ovom su istraživanju provjerene API-je i pretrage više instanci, ali rezultat nije potpun. - Zajednica
localllamanalemmy.mlvratila je 404 pri izravnom dohvaćanju podataka o zajednici (/api/v3/community), pa detalji nisu mogli biti potvrđeni. !«メールアドレス»je bot zajednica koja mehanički prenosi Redditov RSS. Ima 50 pretplatnika i gotovo bez ljudske rasprave; može služiti kao izvor vijesti, ali nije pokazatelj rasprave unutar Lemmyja.- Izravne pretrage zatvorenih video usluga na Lemmyju, poput
Sora,Kling AI,VeoiRunway Gen, gotovo su uvijek vraćale nepovezane objave o mjestima, ljudima ili aktualnim vijestima. Nisu pronađene konkretne rasprave; za Runway je pronađena samo jedna objava o poslovnim rezultatima. - Opseg objava malen je u usporedbi s Redditom: scoreovi su uglavnom jednocifreni ili u desecima. Lemmy sam po sebi nema dovoljnu bazu da bi se trendovi opisali nakon čitanja 20 objava. Ovdje je korišteno sedam različitih upita kroz više instanci, a od pronađenih stvarnih objava odabrani su reprezentativni primjeri.
Pinterest — Vijesti o AI-ju za generiranje slika i videa
Vizualne teme
- Stil „YouTube thumbnaila / naslovne slike bloga” uvjerljivo je najčešći. Tamne do tamnoplave pozadine s neonskim plavim, ljubičastim i narančastim gradijentima te vrlo debelim sans-serif naslovima poput „AI NEWS”, „THE FUTURE IS AI”, „BREAKING NEWS” i „AI IS CHANGING EVERYTHING!”. Češće se radi o naslovnicama članaka i videa o AI-ju nego o samim generiranim sadržajima [2, 7, 11, 38, 39, 42, 48]
- Ljudska lica i portreti središnji su motiv. Animacija izraza, sinkronizacija usana, rekreiranje lica (Microsoft VASA-1) i AI portretne fotografije (ChatGPT+Higgsfield) ponavljaju se kao prikazi slučajeva uporabe „pokreni/stvori lice” [13, 14, 18, 23, 50]
- Vizuali humanoida i robota često služe kao simbol općeg AI-ja. Česte su generičke stock slike bijelog robotskog profila ili žene kiborškog izgleda, bez veze s konkretnim alatom [2, 39]
- Mreže „prije/poslije” i „jedna ulazna slika → više stilova”. Usporedbe pretvaraju stvarni video u drvo, origami, Lego kocke ili buket cvijeća, vjerojatno alatima iz Luma obitelji, te kompozicije plišanih likova u realističnim pozadinama [3, 31]
- Infografike usporedbi i rang-lista alata. Ističu se popisi logotipa, usporedbe „Best Quality (Paid) vs Best Free” i tablice funkcija s kvačicama, namijenjene lakšem odabiru alata [7, 37]
- Sličice s licima stvarnih poznatih osoba. AI-generirani portret nalik Jeffu Bezosu, voditelj u stilu bradatog YouTubera uz „AI NEWS” te fotografija predavanja Nvidijina Jensena Huanga upotrebljavaju se za privlačnost i dojam vjerodostojnosti [11, 36, 40]
- Preklapanje mreže lica / wireframea. Marketinške slike prikazuju mrežaste linije i brojčane oznake preko lica i vrata, evocirajući analizu izraza i biometriju [23, 50]
- Ujednačena paleta boja. Tamna podloga s neonskim akcentima cijan, magenta i žute gotovo je zajednički vizualni jezik pinova povezanih s AI alatima [2, 7, 38, 39, 42]
Istaknuti pinovi
- [1] Image to Video AI: How It Works and Why It Matters — naslovna slika objašnjavajućeg članka s dijagramom stvaranja „vremenske crte videa” iz jedne statične slike.
- [3] Google announces ultra-high quality video... (u stvarnosti demonstracija prijenosa stila s očuvanjem identiteta, nalik Luma alatima) — mreža 3×5 koja izvorni video pretvara u drvo, origami, Lego i cvijeće. Jasna demonstracija mijenjanja teksture uz očuvanje iste osobe i automobila.
- [7] 6+ Best AI Video Generation Websites — infografika za spremanje koja uspoređuje šest alata — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI i Hailuo AI — po funkcijama, ciljanim korisnicima i dostupnosti besplatnog plana.
- [10] Veo 2 — promotivni pin za Googleov VideoFX: fotorealistični kadar osobe koja gleda kroz mikroskop, plivač pod vodom i animirana žena koja pleše sa zviježđima, sažeti na jednoj slici.
- [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — promotivna slika koja prikazuje da Gemini API omogućuje stvaranje videa iz slike i naglašava izvorni zvuk.
- [23] Microsoft Unveils VASA-1 — tehnologija koja od jedne fotografije, zvučnog isječka i proizvoljnih kontrolnih signala stvara izražajan video osobe koja govori gotovo u stvarnom vremenu. Sličica prikazuje lica više etničkih skupina i izraza.
- [27] ShengShu Technology Unveils Vidu S1 — najavni pin za Vidu S1 kineske tvrtke ShengShu Technology, koji naglašava „generiranje u stvarnom vremenu i interaktivno generiranje”, uz vizual lika u cyberpunk stilu.
- [31] Google announces video generation AI 'Veo 3' — četiri izlaza koji ulaznu sliku plišane ljubičaste čudovišne igračke uklapaju u realističnu server-sobu, podvodne ruševine i grad od slatkiša.
- [33] 'Amuse 3.0', an AI art creation tool — najava nove verzije AMD-ova lokalnog alata za generiranje slika, temeljenog na Stable Diffusionu. Među uglavnom zatvorenim modelima to je jedan od rijetkih konkretnih signala lokalnog / otvorenijeg pristupa.
- [42] Breaking News Latest AI Developments — sažetak triju vijesti: agentske funkcije Groka 4.6, Gemini s milijardom korisnika i 150 milijuna generiranih slika dnevno, te Honorov AI robot telefon (datirano 2026-08-12).
Signali
- Zatvoreni modeli izrazito su prisutni. Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6 i Gemini s milijardom korisnika izravno postaju teme pinova velikih tvrtki. Nasuprot tomu, specifična imena tipičnih otvorenih projekata — Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo i LTX — gotovo se uopće ne pojavljuju; iznimka je [33], Amuse 3.0, AMD-ov lokalni alat. Pinterest je vjerojatno više usmjeren na sažetke i usporedbe za opće korisnike i marketinške publike nego na tehničku zajednicu.
- Usmjerenost na stvaranje i pokretanje lica. Sinkronizacija usana, reprodukcija izraza, zamjene za portretno fotografiranje i AI videi nalik voditeljima vijesti opetovano se pojavljuju. To vjerojatno odražava presjek Pinterestove potražnje — ljepota, samoprezentacija i ideje za društvene mreže — s marketingom AI videa.
- Sekundarni sažeci prevladavaju nad primarnim izvorima. Češće su sličice s licem komentatora i naslovnim tekstom te infografike usporedbi nego snimke stvarnih izlaza modela. Pinterest više djeluje kao ulaz prema blogovima, YouTube videima i affiliate člancima nego kao mjesto širenja primarnih najava.
- Signal odsutnosti: u pregledanom uzorku nisu pronađeni pinovi koji spominju japansko govorno područje ili tvrtke, primjerice japanske AI startupove i domaće usluge za generiranje videa. Gotovo sav sadržaj usmjeren je na alate i vijesti s engleskog govornog područja.
Ograničenja
- Od 50 stavki u
output/pinterest.pins.md, stvarno su otvorene i pregledane 24 slike odabrane radi reprezentativnosti. Za preostalih 26 provjereni su samo naslovi; pretpostavlja se da pripadaju istim obrascima — infografikama, portretima i usporedbama alata. - Osam pinova nema naslov, označeni su kao „(untitled)” ([12, 19, 20, 30, 35, 39, 46, 50]). Od njih su pregledani [39] i [50], dok ostali nisu.
- Podaci koje je radnik unaprijed prikupio nemaju podjelu po žanru (
pinterest.pins.mdje jedan ravan popis), pa nije izrađen pregled po žanrovima. - Pinterest se u ovoj fazi nije izravno pregledavao; analiza se, prema uputama playbooka, temelji samo na slikama i naslovima koje je radnik unaprijed prikupio. Podaci ne sadrže metrike angažmana pinova poput lajkova, spremanja ni komentara.
Preporučene radnje
- Ponovno pokrenite X pretragu s izričitim nazivima modela/alata (Stable Diffusion, ComfyUI, Flux, Wan, Kling, Sora), umjesto oslanjanja na popis trendova.
- Izradite stalni popis poznatih Bluesky računa za provjeru putem getAuthorFeeda, jer je
app.bsky.feed.searchPostsu ovom krugu vraćao 403. - Hibridne modele otvorenog i komercijalnog pristupa, poput MiniMaxa H3, izrijekom označite umjesto da ih stavljate u samo jednu kategoriju otvorenog koda.
- Uvedite stalno praćenje velikih zaokreta i gašenja dobavljača, poput Midjourneyjeva medicinskog zaokreta i kraja Sora API-ja, jer su nadmašili čiste vijesti o lansiranju proizvoda na Redditu i Lemmyju.
- Pinterest tretirajte kao pokazatelj raspoloženja potrošača, a ne kao tehnički primarni izvor, s obzirom na gotovo potpuno odsustvo pokrivenosti otvorenog koda.
Prikupljene slike


















































Napomena o kvaliteti podataka
X i Bluesky znatno su podbacili u odnosu na prag od približno 20 objava po platformi iz briefa (X je pokazao samo četiri tematske objave, sve o zatvorenim modelima; Blueskyjev API za pretraživanje vraćao je 403, pa se pokrivenost temeljila na poznatim računima). Reddit, Lemmy i YouTube također su prikupili manje stavki od ciljanog broja, a YouTube zbog JavaScript prikaza stranica nije mogao potvrditi broj pregleda ni pretplatnika.



