KEN’S CAT LOG

Vijesti o AI-ju za generiranje slika i videa — 2026-09-05

GPT-6 „Astra” ovaj je tjedan dominirao zanimanjem za zatvorene modele na X-u i Blueskyju, dok su video/slikovni modeli otvorenog koda (LTX-2.5, MiniMax H3, Qwen-Image-3.0) držali korak gotovo u potpunosti unutar ekosustava ComfyUI-ja, a najveća pojedinačna priča bila je prelazak Midjourneyja s generiranja slika na medicinsku ultrazvučnu opremu.

Pregled vijesti o AI-ju za generiranje slika i videa ~ zatvoreni nasuprot otvorenim modelima ~ — 2026-09-05

Bok! Svijet AI-ja za generiranje slika i videa ovaj je tjedan bio totalni kaoswww🔥 Na strani zatvorenih modela OpenAI-jev GPT-6 „Astra” potpuno je preuzeo pozornost, uz više od 100 milijuna pregleda na X-u (bivšem Twitteru)😳 S druge strane, otvoreni kod nije zaostajao: moćni modeli poput LTX-2.5, MiniMax H3 i Qwen-Image-3.0 izlazili su jedan za drugim s otvorenim težinama, a ComfyUI se učvrstio kao prava matična platforma🛠️ Pomalo zastrašujuća vijest bila je da je Midjourney navodno odustao od generiranja slika i preusmjerio se na tvrtku za medicinske ultrazvučne skenere😱 To je stvarno bilo šokantno. Još jedno otkriće: korisnike Reddita više je pogodila rasprava o „pravnom statusu AI-generiranih sadržaja” nego sam tehnološki napredak!

Kroz platforme

Platformu po platformu

Reddit: mjesečni pregled na r/StableDiffusionu (velik broj izdanja otvorenih modela poput Qwen3.8, DeepSeek-V4-Pro, Ling-3.0 i Gemma-4-31B, tempom koji ni komentari ne mogu pratiti) izvrstan je thread https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ . Pozornost je privukao i World Labsov Atlas, tehnologija koja trenutačno stvara 3D svjetove iz videa/fotografija i može imati primjenu u robotici https://www.reddit.com/r/accelerate/comments/1w5ye9s/ . No najviše je odjeknula ne tehnička vijest, nego thread o presudi da je „AI-generirana dječja pornografija ustavno zaštićena”; čini se da pravne i etičke teme na Redditu stvaraju veću raspravu.

X: pretraga se svela na četiri objave o Astri, pa je GPT-6 Astra imao pozornicu samo za sebe🎤 Najtehničkija je bila objava developera @Dimillian, koji je demonstrirao 3D radni tok „od Blendera do UE5” https://x.com/Dimillian/status/2095596700815516004 . U ovom rasponu pretrage nije pronađena ni jedna objava o otvorenom kodu (Stable Diffusion, Flux, Wan i slično), što je velika rupa u podacima.

YouTube: zatvoreni modeli pokriveni su brojnim usporednim recenzijama, uključujući Nano Banana 2, Kling 3.0 nasuprot Veo3.1 i Sora2 te Seedance2.5 i Seedream5.0 Pro https://www.youtube.com/watch?v=AAD7wJ3DWiA . Otvoreni modeli uključuju LTX-2.5 (iznimno brz model koji stvara deset sekundi videa u 720p za 6,8 sekundi) https://www.youtube.com/watch?v=RjlbDhs1MPk i HunyuanImage3.0 (MoE s 80B parametara) https://www.youtube.com/watch?v=U-8RjjU7x14 . Otvorene težine već se uspoređuju sa zatvorenim konkurentima odmah nakon predstavljanja. Pojavila se i priča da OpenAI gasi Sora API i koncentrira resurse na idući model „Spud” (sam YouTube video nije potvrđen, informacija dolazi preko vijesti).

Bluesky: redoviti „benchmark slike pelikana” Simona Willisona postao je stalna točka za provjeru kvalitete zatvorenih modela https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . Službeni račun Replicatea djeluje kao centar brzih objava za video modele kao što su Kling3.0, Seedance2.0, Runway Gen-4.5 i Vidu Q3 https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c . Gotovo da nema primarnih objava o otvorenom kodu; čak je i ostris, autor LoRA alata, rekao da je „AI/ML zajednica uglavnom ostala na X-u (Twitteru)”😅 Japanski sadržaj uglavnom se svodi na dijeljenje GIGAZINE-ova članka o Qwen-Image-3.0 https://gigazine.net/news/20260722-qwen-image-3/ .

Lemmy: !«メールアドレス» ima najveću gustoću informacija o otvorenom kodu. Gotovo polovica objava odnosila se na MiniMax H3 (Comfy kao komercijalni reseller https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller , alati koji rade s 16 GB VRAM-a i sl.). Zanimljiv je i LLaDA-Image, s potpuno objavljenim receptom za treniranje https://arxiv.org/abs/2609.03796 . Kod zatvorenih modela, vijest o Midjourneyjevu prijelazu s generiranja slika na medicinske ultrazvučne skenere imala je daleko veći score (58–73) od novih modela i bila glavna tema zajednice.

Pinterest: vizualno su zatvoreni modeli uvjerljivo dominantni — Google Veo2/3, Microsoft VASA-1, Grok4.6 i Gemini s milijardom korisnika česti su motivi sažetih grafika. Od posebnih imena otvorenog koda jedva se vidi išta osim AMD-ova lokalnog alata „Amuse 3.0”. Vrlo su česti slučajevi uporabe koji „pokreću ili stvaraju lica” — sinkronizacija usana, reprodukcija izraza i izrada portreta — vjerojatno zato što se dobro podudaraju s Pinterestovom publikom zainteresiranom za ljepotu i sadržaj za društvene mreže.

Što pratiti

  1. Nastavak priče o GPT-6 Astri usmjerenoj na slike/video — X, https://x.com/flowith/status/2095750768204877858(najava usporedbe animacije GPT-6 Astra i GPT-5.6, uskoro)
  2. Gašenje Sora API-ja → idući model „Spud” — prema YouTube istraživanju, API bi trebao biti ugašen 2026-09-24. Nitko još nije potvrdio stvarne snimke ni funkcije.
  3. Razvoj komercijalnog licenciranja MiniMaxa H3 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (hoće li se ustaliti hibridni pristup: otvorene težine, ali plaćena komercijalna uporaba)
  4. Midjourneyjev zaokret prema medicinskim uređajima — Lemmy, https://lemmy.zip/post/66397234 (napušta li etablirani zatvoreni igrač ozbiljno AI generiranje slika)
  5. Potpuno otvoreni recept za treniranje LLaDA-Imagea — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (u kojoj će se mjeri ubuduće kopirati otvoreni model s vrhom Qwen-Image-Bencha)
  6. Atlas World Labsa — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (kako će se generiranje 3D svjetova iz videa prenijeti na podatke za treniranje robota)

Preporuke

  1. X bi trebalo ponovno pretražiti ne oslanjajući se na trendove, nego koristeći konkretne oznake poput „Stable Diffusion”, „ComfyUI”, „Flux”, „Wan”, „Kling” i „Sora”.
  2. Budući da Blueskyjev API searchPosts nije radio zbog 403 odgovora, za sljedeći put bi bilo učinkovitije unaprijed proširiti popis poznatih računa putem Google pretrage.
  3. Modele poput MiniMaxa H3, koji imaju otvorene težine ali se komercijalno koriste uz naknadu, u izvješću treba označiti napomenom umjesto da ih se jednostavno svrstava u „otvorene”.
  4. Vijesti o povlačenju ili zaokretu velikih igrača, poput Midjourneyjeva zaokreta i gašenja Sore, zaslužuju trajnu kategoriju praćenja jer čitateljima privlače više pažnje od tehničkih vijesti.
  5. Budući da Pinterest ima malo primarnih informacija, bolje ga je koristiti kao termometar percepcije općih korisnika nego kao izvor za praćenje tehničkih trendova.
  6. Trend s Reddita i Lemmyja — da sudske odluke i etičke kontroverze stvaraju više buke od tehničkih vijesti — vrijedi izdvojiti kao zaseban signal i u sljedećim sažecima.

Kvaliteta podataka

  • X: prikupljene objave potjecale su iz trendova vezanih uz hrvatsku regiju, pa su osim četiri objave o GPT-6 Astri predstavljale nepovezan šum (kriptovalute, Elonova zajednica, sport itd.). Nije bilo ni jednog spomena otvorenog koda, pa nije ostvaren cilj od 20 analiziranih objava.
  • Bluesky: službeni API za pretraživanje vraćao je 403, pa je pristup promijenjen na provjeru pojedinačnih feedova poznatih računa. Pronađeno je tek oko 12 izravno relevantnih objava, uz gotovo nikakve primarne informacije o otvorenom kodu.
  • Reddit: uz samo jedan upit prikupljeno je 12 threadova iz devet subreddita, manje od ciljanih 20. Ipak, zabilježeno je najviše šest vodećih komentara po threadu.
  • YouTube: zbog JavaScript prikaza stranica rezultata i videa nije bilo moguće izravno potvrditi broj pregleda, pretplatnika ni točan datum objave; datumi su procijenjeni iz relativnih oznaka u isječcima.
  • Lemmy: zbog federirane prirode mreže pretraga jedne instance propušta objave s drugih instanci. Izravne pretrage zatvorenih video servisa (Sora, Kling, Veo i slično) gotovo da nisu dale rezultate.
  • Pinterest: od 50 stavki otvorene su i stvarno provjerene samo 24 slike; za ostale su bili dostupni samo naslovi. Podaci ne sadrže metrike angažmana poput lajkova i spremanja.

Sažetak po platformama

Reddit

Reddit — Vijesti o AI-ju za generiranje slika i videa

Gdje

Prikupljenih 12 threadova dolazi iz devet subreddita. Korišten je samo upit „Image and Video Generation AI News”.

Subreddit Broj pretplatnika Broj prikupljenih threadova
r/generativeAI 150,575 4
r/GrokAiDiscussion 4,883 1
r/freetoolsAI 7,616 1
r/StableDiffusion 1,000,814 1
r/accelerate 77,800 1
r/news 31,531,475 1
r/antiai 313,317 1
r/allthequestions 127,064 1
r/teenagers 3,673,210 1

r/generativeAI ima najviše objava (četiri) i središte je opuštenih objava o traženju i usporedbi alata. Drugdje je pronađena po jedna objava; osobito je primjetno da se tema prelila i u subreddite koji nisu specijalizirani za generiranje slika/videa, poput r/newsa i r/teenagersa.

Što ljudi govore
  • #4 r/StableDiffusion „Local AI News You Missed - August 2026” (201pt · 22 komentara · 2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — mjesečni pregled navodi velik broj izdanja otvorenih modela tijekom kolovoza, uključujući Qwen3.8, DeepSeek-V4-Pro-0813, seriju Ling-3.0 i Gemma-4-31B. Dodatne prijave u komentarima pristizale su jedna za drugom: u/Narutobirama(20) navodi Qwen3.8 Flash Next, a u/MoJaKF(14) Anima-3.8B 1.1, što pokazuje tempo koji čak ni pregledna objava ne može pratiti.
  • #5 r/accelerate „…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground” (763pt · 76 komentara · 2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — World Labsov Atlas stvara interaktivne 3D svjetove iz videa/fotografija. Reakcije poput u/stainless_steelcat(48), „Matrix bullet time comes to real life...now I know it wasn't ambitious enough.”, bile su oduševljene, uz raspravu o mogućoj primjeni video generiranja za podatke za treniranje robota.
  • #6 r/generativeAI „Same prompt. Same 30 seconds. Two different AI video models.” (98pt · 30 komentara · 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — usporedba Seedancea 2.5 i Wana 3.0 s istim promptom. u/SpecialistDragonfly9(5) smatra da je „seedance is the by FAR superior one”, dok u/Positive-Key6640(4) dovodi u pitanje samu metodologiju: „Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better”.
  • #2 r/GrokAiDiscussion „Have they loosened the image to video generation moderation” (14pt · 28 komentara · 2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — iskustva korisnika s pravilima moderiranja Grok Imaginea su podijeljena. u/Miserable_Appeal515(2) kaže „it has gotten better”, dok u/joderrelldalejr(2) odgovara: „Hell no it gets worse and then they start to limit how many images you can even do in a week”.
  • #1 r/generativeAI „List of daily AI video generative websites” (38pt · 27 komentara · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — razmjena savjeta za korisnike koji maksimalno koriste besplatne kvote. Kling AI navodno ima „66 free credits every 24 hours”, u/Murky-Race-3443(1) navodi da CapCut daje dnevne besplatne kredite, a u/Julia_Leeds94(1) predstavlja YalleryLabs, gdje petosekundni video u 720p počinje od $0.18 uz budžet od $3.
  • #3 r/freetoolsAI „Free AI Image Generator” (31pt · 31 komentar · 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — promotivna objava za generator slika bez registracije prikupila je komentare; u/Odd-Lingonberry1516(2) navodi alternative Deepany, Aifun i Perchance. u/thecragmire(1) pita: „How do you maintain this? It's got to cost you something, right?”
  • #11 r/generativeAI „GOOD image-to-video ??” (1pt · 13 komentara · 2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI opisan je kao „practically king of the hill for realistic human motion”, a Runway kao „The gold standard for creative control”; za lokalni rad u/Ok-Addition1264(2) preporučuje ComfyUI + WAN22/LTX2.3.
  • #7 r/generativeAI „Any good Ai video site ? Even if it paid ?” (0pt · 15 komentara · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) ocjenjuje Runwayjev gen-3 kao alat koji „actually handles motion pretty well compared to a lot of the jank”, dok je Pika „fun for quick little loops...but the output gets samey after a while”.
  • #8/#10 r/news „Federal Judge rules AI generated child sex abuse material is protected by First Amendment.” (1,379pt · 545 komentara · 2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) i r/allthequestions „Why did a federal judge declare the creation of AI generated child porn as legal?” (31pt · 277 komentara · 2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — rasprava o pravnom statusu AI-generiranog sadržaja skupila je izniman angažman. u/Ntroepy(414) upozorava da je naslov obmanjujući i vezan uz presudu Vrhovnog suda iz 2002., dok u/TheGracefulCrane(31) objašnjava: „judges dont make laws and the law hasnt been updated to make it illegal ergo the ruling”.
  • #9 r/antiai „AI generated images are becoming harder to detect” (113pt · 30 komentara · 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — unatoč naslovu, komentari su se uglavnom šalili na račun pogrešno generiranih udova, primjerice u/GurInside278(31): „why are her feet her hands”.
  • #12 r/teenagers „To all AI image/video generator users” (7pt · 41 komentar · 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — objava koja osporava tvrdnju da „AI umjetnost ne zahtijeva rad umjetnika”. Komentari poput u/LiterallyGarbage_0(5), „people who use ai to make "art" genuinely make me so upset...pick up a pencil”, pokazuju snažno anti-AI raspoloženje među tinejdžerima.
Signali
  • Rast: učestalost izdanja lokalnih otvorenih modela za LLM-ove, slike i video raste toliko brzo da je ni komentare threada #4 teško pratiti. Novi smjer uzbuđenja čine i primjene poput Atlasova (#5), gdje video generiranje služi za podatke u robotici.
  • Sukob mišljenja: izvješća o moderiranju Grok Imaginea (#2) potpuno su podijeljena između „bolje je” i „gore je”. Kod Seedancea nasuprot Wanu (#6) uz tvrdnje da Seedance uvjerljivo pobjeđuje stoji prigovor da usporedba s istim promptom sama po sebi nema veliku vrijednost.
  • Podcijenjeno / dovedeno u pitanje: standardni format usporedbe modela s istim promptom (#6) u/Positive-Key6640 kritizira kao metodologiju.
  • Iznenađenje: thread #9, naslovljen kao da će govoriti o težem prepoznavanju AI slika, zapravo se pretvorio u šale o pogrešno generiranim udovima. Usto, pravne odluke (#8 i #10, ukupno više od 800 komentara) ostvarile su daleko veći angažman od produktnih vijesti: na Redditu su pravna i etička pitanja AI sadržaja veći izvor sukoba od tehnološkog napretka.
Ograničenja
  • Upotrijebljen je samo jedan upit, „Image and Video Generation AI News”, pa je prikupljeno 12 threadova iz devet subreddita, manje od otprilike 20 objava po mreži koje zahtijeva brief.md.
  • U ovoj se fazi samo čitalo unaprijed prikupljene datoteke output/reddit.threads.md/.threads.json; nisu se izvodile dodatne pretrage ni izravno pristupalo pojedinačnim threadovima ili komentarima, prema uputama playbooka. Mogući propusti najvjerojatnije su izvan dosega tog jednog upita.
  • Za svaki thread zabilježeno je najviše šest vodećih komentara, pa reakcije niže na listi i manjinska mišljenja nisu uvršteni.

X

X — Vijesti o AI-ju za generiranje slika i videa

Računi

Od 34 računa u ovoj zbirci, samo su četiri objavila nešto povezano s AI-jem za generiranje slika/videa — svi o istom lansiranju, unutar ista 24 sata (2026-09-03):

  • @OpenAI (OpenAI) — jedna objava, ali ona je cijela priča: 309,095 lajkova,
    55,587 repostova, ~108,000,000 pregleda. Račun je učinio minimum (jedan
    najavni tweet sa slikom), a ostalo je napravio volumen.
  • @MatthewBerman (Matthew Berman) — račun AI influencera, jedna objava
    (4,054 lajkova, ~1,500,000 pregleda), oblikovana kao thread s prvim dojmovima
    uz „rani pristup”, čime se pozicionira kao tester, a ne izvor.
  • @Dimillian (Thomas Ricouard) — jedna objava (7,199 lajkova, ~2,300,000 pregleda),
    developer pokazuje konkretan radni tok (Blender → Unreal Engine 5), umjesto
    općeg hypea — najkonkretnija tehnička tvrdnja u skupu.
  • @flowith (Flowith) — najmanji račun ovdje (947 lajkova, ~115,000 pregleda),
    produktni račun koji koristi lansiranje za usporedbu s prethodnim modelom.

Svi drugi računi u zbirci (ukupno 34 računa i 40 objava) — računi za kripto/memeove (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), fan računi Elona/Tesle (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), influencer za kibernetičku sigurnost (@corewarrior, @hackerzspace), poljski/afrički/bosanski računi s vijestima i memeovima, fan računi Ariane Grande (@vodolove je objavio 3 od 4 stavke), te računi nagradnih igara pivskih brendova (@naturallight, @ChinookCi) — nemaju veze s AI-jem za generiranje slika ili videa. Navedeni su samo zato što ih je zbirka stvarno vratila; pogledajte Ograničenja.

Objave
1. Lansiranje GPT-6 „Astra” — @OpenAI

„Ovo je GPT-6 Astra. Sve što možete napraviti na računalu, Astra može napraviti za vas. Brzo.”

Najveća pojedinačna objava u cijelom prikupljenom skupu, za red veličine. Predstavljena je kao opći agent za rad na računalu, a ne kao model posebno za slike/video — no demonstracije drugih računa u nastavku sve su vizualne ili 3D, što sugerira da su Astrine demonstrirane prednosti upravo na toj strani.

2. Astra nasuprot prethodnom modelu, u okviru animacije — @flowith

„GPT-6 Astra VS GPT-5.6 u animaciji uskoro na flowith.io”

Račun proizvoda treće strane izričito najavljuje usporedbu Astre i prethodne generacije u animaciji — konkretan signal da se Astra testira i promovira upravo za sposobnosti generiranja animacije, a ne samo za opći rad na računalu.

3. Thread s ranim pristupom — @MatthewBerman

„Astra (GPT-6) je stigla!!! Imao sam rani pristup i ludo je testirao na igrama, kodu, pisanju, kontroli preglednika, prezentacijama i općem znanju. Ovo je najbolji model koji sam ikad koristio. Točka.”

Primjetno je ono što ne spominje: generiranje slika ili videa nije izrijekom navedeno na popisu mogućnosti, iako thread najavljuje „nevjerojatne demonstracije ispod”.

4. Prikaz rada od Blendera do Unreal Enginea 5 — @Dimillian

„Astra je vrlo dobra u 3D modeliranju i jedva čekam da to svi iskusite. Za sada, evo kratkog prikaza kako sam izradio demo kuću za našu objavu o lansiranju: od Blender scene do iskustva za šetnju u Unreal Engineu 5.”

Najkonkretnija tvrdnja vezana uz specifične alate u zbirci: Astra se koristi u stvarnom 3D produkcijskom toku (Blender → UE5), što je bliže radu s videom/vizualima od bilo čega drugog što je X pokazao u ovom krugu.

Signali
  • Rast: GPT-6 „Astra” jedina je priča povezana sa slikama/videom koju je ova zbirka pronašla i uvjerljivo dominira angažmanom (~108 milijuna pregleda samo za najavnu objavu nasuprot nekoliko stotina tisuća za ostalo). Skup reakcija unutar 24 sata — usporedba proizvoda, influencerovi prvi dojmovi i developerova 3D demonstracija — djeluje kao koordinirano lansiranje, a ne organsko otkrivanje.
  • Odsutno / zanemareno: nijedan model otvorenog koda za generiranje slika ili videa (Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI itd.) ne pojavljuje se nigdje u ovoj zbirci. Ako se takav rad trenutačno odvija na X-u, ovaj ga krug pretrage nije dosegnuo.
  • Iznenađenje: koliko malo diskursa o lansiranju „AI-ja” zapravo navodi generiranje slika ili videa kao funkciju — popis Matthew Bermana to potpuno izostavlja, a Astra se reklamira kao opći agent („sve što možete na računalu”). Aspekt slika/videa zaključuje se iz onoga što su rani testeri odlučili demonstrirati (3D modeliranje, usporedba animacija), a ne iz OpenAI-jeva vlastitog uokviravanja.
Ograničenja
  • Prikupljene pretrage nisu ciljale ovu temu. Deset stvarno pretraženih izraza — „Astra”, „$SONG”, „Robinhood”, „Elon”, „#CyberSecurity”, „Poland”, „Africa”, „Bosnia”, „ariana”, „#Sweepstakes” — bili su X-ov vlastiti popis trendova u ovoj sesiji (pogledajte tablicu Explore u x.posts.md), a ne pojmovi odabrani za AI generiranje slika/videa. Samo je pretraga „Astra” (objave #1–4) bila relevantna; ostalih 36 objava čine nepovezan šum iz pogrešno odabranog popisa.
  • Kriteriji dovršenosti nisu ispunjeni. Brief traži analizu oko 20 objava po platformi; ova zbirka ima samo četiri upotrebljive objave, sve o jednom zatvorenom lansiranju (GPT-6 Astra), i nula o otvorenom generiranju slika/videa. Za stvarnu pokrivenost bilo bi potrebno pretražiti pojmove poput „Stable Diffusion”, „ComfyUI”, „Flux”, „Kling AI”, „Runway”, „Sora”, „Midjourney”, „Wan 2.x” ili „HunyuanVideo”.
  • Napomena o geolokaciji: X-ov popis trendova u ovoj je sesiji geolociran na Hrvatsku (većina stavki izričito je označena kao „Trending in Croatia”), zbog čega kripto tokeni, bosanski nogomet i vijesti/memeovi iz balkanske regije prevladavaju u popisu — to su trendovi jednog položaja poslužitelja, a ne globalna slika.
  • Potpuni nedostatak pokrivenosti otvorenog koda. Ništa u ovoj zbirci ne dotiče vijesti, alate ni izdanja otvorenog koda za generiranje slika ili videa — taj je nedostatak potpun, a ne djelomičan.

YouTube

YouTube — Vijesti o AI-ju za generiranje slika i videa (zatvoreni / otvoreni kod)

Kanali

Kanali pronađeni putem YouTube pretrage i pretrage vijesti. Za većinu nije bilo moguće izravno potvrditi broj pretplatnika jer se video stranice prikazuju JavaScriptom (detalji u ## Ograničenja).

  • Theoretically Media — poznati kanal koji Wan, FLUX, Qwen-Image i druge AI-je za generiranje otvorenog koda redovito testira u ComfyUI-ju. („Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...” https://www.youtube.com/watch?v=3BFDcO2Ysu4)
  • Matt Wolfe / The Next Wave — poznati po usporedbama zatvorenih AI alata kao što su Runway, Kling, Veo i Sora.
  • Više pojedinačnih AI kanala koji objavljuju recenzije modela LTX-2.5, MiniMax H3 i Nano Banana 2 (nazivi kanala nisu se pojavili u rezultatima pretrage; potvrđeni su samo naslovi videa).
Videozapisi
Zatvoreni modeli
  1. „Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!” — oko 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — praktični test Googleova Gemini 3.1 Flash Imagea, poznatog kao Nano Banana 2, uz tvrdnju da rješava kompromis između brzine i kvalitete slike.
  2. „Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To” — kraj veljače 2026. — https://www.youtube.com/watch?v=B1d3SIfoQLk — usporedba izlaza standardne i Pro verzije te procjena koju koristiti.
  3. „Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2” — oko 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — izravna usporedba Kuaishouova Klinga 3.0 s Veo 3.1 i Sora 2; Kling dobro prolazi u realizmu snimke i radu kamere.
  4. „Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)” — oko 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — plaćeni praktični test Klinga 3.0, uključujući višekadrovsku generaciju i 4K pri 60 fps.
  5. „Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!” — oko 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — test ByteDanceova slikovnog modela Seedream 5.0 Pro i još neobjavljenog Seedancea 2.5; navodi se da je ByteDance preskočio Seedance 2.1.
  6. „Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?” — oko 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — provjera tvrdnje da Seedance 2.5 može stvoriti 30 sekundi kontinuirane snimke u jednom kadru.
  7. „MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model” — početak kolovoza 2026. — https://www.youtube.com/watch?v=67CCQBAwZiA — praktični test MiniMaxa H3 (Hailuo 3.0), izdanog 2026-07-31, s potvrdom 2K, 15 sekundi i izvornog stereo zvuka.
  8. „Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)” — oko kolovoza 2026. — https://www.youtube.com/watch?v=la0iBk8g8_g — potpuni test omnimodalnih funkcija MiniMaxa H3, koje istodobno prihvaćaju tekst, sliku, video i zvuk.
  9. „FLUX 3 Sneak Peek” — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — najava Black Forest Labsova FLUX-a 3, multimodalnog modela za slike, video od 20 sekundi, zvuk i akcije; video funkcija postala je opće dostupna 2026-08-04.
  10. „Gen-4.5 Updates — Research Demo Day 2025 | Runway” — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — službeni Runwayjev pregled tehničkih nadogradnji Gen-4.5, uključujući kontrolu kamere i konzistentnost likova.
  11. „All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!” — nedavno — https://www.youtube.com/watch?v=SnmRpf_VfgU — video o korištenju besplatnih kvota više zatvorenih AI-jeva, uključujući Kling, Veo, Sora i Nano Banana Pro.
Otvoreni modeli
  1. „LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch” — sredina kolovoza 2026. (oko tri tjedna nakon javne objave otvorenih težina LTX-2.5 2026-08-11) — https://www.youtube.com/watch?v=RjlbDhs1MPk — izvorna integracija Lightricksova 22B svjetskog modela LTX-2.5 u ComfyUI i potvrda stvaranja desetosekundnog 720p videa za 6,8 sekundi.
  2. „LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows” — oko tri tjedna ranije — https://www.youtube.com/watch?v=WpKNXZZqQEU — izravna usporedba otvorenog LTX-2.5 sa zatvorenim MiniMaxom H3 na fizici i višekadrovskim scenama.
  3. „New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)” — oko tri tjedna ranije — https://www.youtube.com/watch?v=pA2BQw9LY8A — test usmjeren na brzinu lokalnog izvođenja.
  4. „Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — vodič kroz Wan 2.2 (MoE video model), FLUX, FLUX Krea i Qwen Image u ComfyUI-ju. Wan 2.2 ocijenjen je kao model s konzistentnošću bliskom Sori, a FLUX kao bolji u detaljima.
  5. „HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet” — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — predstavljanje Tencentova slikovnog MoE modela s 80B parametara; navodi se tijesna prednost u pobjedama nad Seedreamom 4.0, Nano Bananom i GPT-Imageom.
  6. „Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!” — oko 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — recenzija i ComfyUI postavljanje FLUX.2, uključujući verziju otvorenih težina; opisuje održavanje konzistentnosti subjekta uz do deset referentnih slika.
  7. „FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret” — oko 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — postupak instalacije FLUX.2 u ComfyUI i objašnjenje novih funkcija.
  8. „Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)” — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — prvi lokalni test Alibaba Qwen-Imagea, prethodnika kasnijeg Qwen-Image-2512.
  9. „Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow” — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — provjera prijenosa stila s više referentnih slika u Qwen Image Editu putem GGUF radnog toka u ComfyUI-ju.
  10. „MiniMax H3: The New Open-Source Video Champ?” — oko kolovoza 2026. — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3 predstavljen je kao omnimodalni video model s otvorenim težinama, uz spomen prvog mjesta na rang-listi uređivanja videa.
Signali
  • Otvorene težine ubrzano se približavaju vrhu: LTX-2.5 (2026-08-11) i MiniMax H3 (2026-07-31) oba su objavljena s otvorenim težinama unutar posljednjih 60 dana; ističu se usporedne sličice koje ih uspoređuju sa zatvorenim konkurentima. Otvoreni modeli više nisu samo „sljedbenici”, nego se uspoređuju odmah nakon objave.
  • ByteDanceov brzi ciklus izdanja: Seedream 5.0 Pro i Seedance 2.5, uz preskakanje verzije 2.1, ažuriraju se svakih nekoliko mjeseci, a YouTuberi objavljuju brze provjere pod naslovima poput „Tested” i „Leaks”.
  • Preslagivanje Googleova portfelja: cijela Imagen linija trebala bi biti ugašena 2026-08-17, uz prijelaz na Nano Banana modele iz serije Gemini 3.x Image. Za Nano Banana 2, izdan 2026-02-26, već postoji više usporednih videa s nasljednicima, poput Pro verzije.
  • Povlačenje velikog zatvorenog igrača: OpenAI planira ugasiti Sora API 2026-09-24 i računalne resurse usmjeriti na nadolazeći model „Spud” (prema rezultatima pretrage; YouTube video nije potvrđen). To je važna prekretnica za trend zatvorenih modela.
  • ComfyUI je de facto baza za testiranje otvorenog koda: gotovo svi videi o otvorenim modelima, uključujući Wan, FLUX, Qwen-Image i LTX-2.5, dolaze uz postupak instalacije u ComfyUI-ju.
Ograničenja
  • YouTubeove stranice rezultata (youtube.com/results?...) i videa (youtube.com/watch?v=...) prikazuju se JavaScriptom; izravno dohvaćanje vraćalo je samo navigacijske poveznice u podnožju, pa nije bilo moguće očitati sirove podatke kao što su broj pregleda, broj pretplatnika ili ytInitialData. Datumi su zato procijenjeni prema isječcima tražilice („3 weeks ago” i slično) ili navodima u člancima; za većinu videa nisu potvrđeni točan broj pregleda i broj pretplatnika kanala.
  • Nije pronađen izravan YouTube video o OpenAI-jevu gašenju Sore i nasljedniku „Spud”; stavka se oslanja na spominjanje u člancima, a reakcije na YouTubeu nisu potvrđene.
  • Pronađene su službene objave Runwaya Gen-4.5 i Midjourneyjevih novijih ažuriranja, ali ne i nedavne nezavisne recenzije unutar zadnjih 60 dana.
  • Za pojedinačne videe o Nano Banana Pro, uključujući naslov „Nano Banana Pro… wtf”, potvrđene su poveznice, ali ne i naziv kanala ni broj pregleda.

Bluesky

Bluesky — Najnoviji trendovi AI-ja za generiranje slika i videa

Računi
  • Simon Willison @simonwillison.net — developer poznat po evaluaciji LLM-ova i slikovnih modela. Pri svakom izlasku novog modela objavljuje usporedbu slika kroz svoj redoviti „benchmark pelikana”. Reakcije pratitelja čine ga korisnim primarnim izvorom za vijesti o zatvorenim modelima.
  • fofr @fofr.ai — autor slikovnih promptova iz Replicate kruga. Često dijeli praktične načine uporabe Nano Banana Proa (Gemini 3 Pro Image).
  • Replicate (službeni) @replicate.com — službeni račun tvrtke za API hosting AI modela. Objavljuje najave kad model stigne na Replicate i služi kao brz izvor izdanja video modela, zatvorenih i otvorenih.
  • Amanda Silberling (novinarka TechCruncha) @amanda.omg.lol — novinarka koja prati kulturnu stranu AI generiranja slika.
  • AI News Updates @ai-latestnews.bsky.social — bot račun za automatske objave vijesti iz AI industrije.
  • gigowat @gigowat.bsky.social — račun koji na Blueskyju dijeli članke japanske tehnološke stranice GIGAZINE. Jedan je od rijetkih izvora vijesti o generiranju slika na japanskom.
  • ostris @ostris.com — autor alata otvorenog koda za LoRA treniranje „AI-Toolkit”. Objavljuje o modelima iz obitelji Flex, ali prema vlastitim riječima „AI/ML zajednica uglavnom je ostala na Twitteru”, pa su ažuriranja na Blueskyju rijetka.
Objave
  1. Simon Willison — objavio usporednu mrežu slika pelikana iz GPT-6 Astre i GPT-5.6 Sol/Terra/Luna (zatvoreni modeli, usporedba OpenAI-jevih slikovnih modela). 2026-09-04, 👍91 · 🔁6 · 💬12.
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    U nastavku je objavio i punu veličinu generirane slike (alt tekst također je generirao GPT-5-astra). 👍23.
    https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c

  2. Simon Willison — usporedna objava slike pelikana generirane Google Gemini 3.7 Flashom. 2026-09-02, 👍6.
    https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r

  3. fofr — podijelio detaljan prompt za rekreiranje renderiranja u stilu retro igre uz Nano Banana Pro (Gemini 3 Pro Image). 2026-01-19, 👍31.
    https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
    Istoga je dana objavio i prompt za stvaranje snimke zaslona nalik Street Viewu. 👍10.
    https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m

  4. Replicate (službeni) — objavio da je OpenAI-jev „GPT Image 2” dostupan na Replicateu. Ističe fotorealizam, preciznost ispisivanja teksta te primjenu u UI-ju i dizajnu (zatvoreni model). 2026-04-21.
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  5. Replicate (službeni) — objavio da je ByteDanceov video model „Seedance 2.0” otvoren svim korisnicima. Ujedinjuje tekst, sliku, video i zvuk u jednu scenu te sinkronizirano stvara stereo zvuk (zatvoreni model). 2026-04-09.
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  6. Replicate (službeni) — Runwayjev Gen-4.5 dodan je na Replicate; video model naglašava fizički realizam (zatvoreni model). 2026-02-18.
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  7. Replicate (službeni) — Kuaishouov Kling 3.0 (+o3) dodan je na Replicate; podržava višekadrovni 4K i sinkronizaciju zvuka (zatvoreni model). 2026-02-17.
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  8. Replicate (službeni) — video model „Vidu Q3” dodan je na Replicate. Podržava generiranje iz teksta, slike te početnog/završnog kadra, do 16 sekundi i 1080p (zatvoreni model). 2026-03-11.
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

  9. Amanda Silberling (TechCrunch) — objava kojom traži komentare stručnjaka o tome zašto AI-generirane slike hrane često imaju prepoznatljiv izgled; novinarski upit o estetskim posebnostima AI slika. 2026-08-28, 👍17 · 🔁5 · 💬4.
    https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x

  10. AI News Updates (bot) — izvijestio da je „Midjourney Inc. kupio astrološku aplikaciju Co-Star i pokreće novu aplikaciju za generiranje slika”. 2026-07-25. Sadržaj se podudara s izvještajima TechCruncha i Bloomberga od 2026-07-24, prema kojima je preuzimanje zaključeno tog proljeća, pa ga je moguće provjeriti.
    https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s

  11. gigowat (dijeljenje GIGAZINE-ova članka na japanskom) — podijelio članak o otvorenom AI-ju za generiranje slika „Qwen-Image-3.0”, s provjerom performansi za ilustracije i japanski tekst. 2026-07-22.
    https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
    (izvorni članak: https://gigazine.net/news/20260722-qwen-image-3/

  12. ostris — objavio izdanje otvorenog slikovnog modela „Flex.2-preview”, koji objedinjuje generiranje slike iz teksta, univerzalnu kontrolu i inpainting. Objavu iz 2025-04-22 treba smatrati starijom, ali je jedan od rijetkih primjera da autor otvorenog modela izravno objavljuje na Blueskyju. 👍4.
    https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a

Signali
  • Prednost zatvorenih modela: objave na Blueskyju koje stvarno ostvaruju angažman koncentrirane su oko velikih zatvorenih modela — GPT-a, Geminija/Nano Banana Proa i Midjourneyja. Willisonov „benchmark pelikana” postao je praktički stalno mjesto za provjeru kvalitete zatvorenih slikovnih modela pri izlasku novih verzija.
  • Replicate kao brzi centar za video modele: Kling 3.0, Seedance 2.0, Runway Gen-4.5 i Vidu Q3 redom su objavljeni preko službenog Replicate računa. Broj lajkova malen je (1–2), ali račun je koristan za praćenje vremenskog slijeda pojave modela.
  • Otvoreni modeli slabo su zastupljeni na Blueskyju: gotovo da nema primarnih spomena glavnih otvorenih modela s težinama iz 2026., poput Wana 2.7, HunyuanVideoa 1.5, Chrome, LTX-2.3 i drugih. Čak i ostris navodi da je AI/ML zajednica uglavnom ostala na Twitteru, što sugerira da je težište zajednice na X-u.
  • Objave na japanskom uglavnom su dijeljenja GIGAZINE-a: japanski sadržaj uglavnom se svodi na dijeljenje članaka s novinskih stranica, bez pronađenih izvornih analitičkih objava.
Ograničenja
  • Službeni Blueskyjev API za pretraživanje objava (app.bsky.feed.searchPosts) stalno je vraćao 403 Forbidden u ovoj sesiji WebFetcha, pa nije bilo moguće sustavno prikupiti objave prema ključnim riječima s brojem lajkova i repostova. Metoda je prebačena na pojedinačnu provjeru feedova poznatih računa s getAuthorFeed; getProfile, getAuthorFeed, getPostThread i oEmbed radili su normalno.
  • Sama Blueskyjeva stranica za pretraživanje, bsky.app, SPA je koja se prikazuje JavaScriptom, pa WebFetchov pretvarač HTML-a u Markdown nije mogao dohvatiti tekst objava.
  • Zbog navedenih ograničenja nije bilo moguće iscrpno provjeriti sve objave prema određenim nazivima modela; umjesto toga izdvojene su relevantne objave iz nedavnih feedova poznatih računa. Provjereno je nešto više od 20 objava/feedova, ali je samo oko 12 pronađenih objava bilo izravno povezano s generiranjem slika/videa.
  • Za glavne otvorene modele s težinama (Wan, HunyuanVideo, Chroma, sam Z-Image, LTX-2.3 i slično) na Blueskyju nisu pronađene relevantne objave iz 2026. Probani su brojni računi; huggingface.bsky.social imao je prazan feed, a civitai-bot.bsky.social nije ažuriran od svibnja 2024.
  • Pronađena je osobna objava iz veljače 2026. koja tvrdi da je Midjourney postao dio Meta.ai-ja, ali je vanjska provjera pokazala da je riječ o licencnom ugovoru iz kolovoza 2025., pri čemu je Midjourney ostao neovisan. Zbog netočnosti nije uključena u izvješće.

Lemmy

Lemmy — Najnoviji trendovi AI-ja za generiranje slika i videa (zatvoreni / otvoreni modeli)

Zajednice
  • !«メールアドレス» — 5,708 članova. Tehničke rasprave o AI-ju otvorenih težina za generiranje slika i videa. Zajednica s najvećom gustoćom relevantnih informacija u ovom istraživanju.
  • !«メールアドレス» — 2,360 članova. Mjesto za radove stvorene modelima iz obitelji Stable Diffusion; malo je samih vijesti.
  • !«メールアドレス» — 1,593 člana. Namijenjena anime AI umjetnosti, s malo vijesti.
  • !«メールアドレス» — 50 članova. Automatski RSS prijenosi s Reddita; treba imati na umu da se ne radi o ljudskoj raspravi.
  • !«メールアドレス» i !«メールアドレス» — opće tehnološke vijesti. Malo je zasebnih objava o generiranju slika/videa; tema se gubi među člancima o AI-ju općenito.
  • Na Lemmyju ne postoji velika zajednica specijalizirana za AI generiranje slika/videa, usporediva s r/StableDiffusionom na Redditu; rasprava je raspršena među manjim zajednicama navedenima iznad.
Objave
Otvoreni modeli
  1. MiniMax H3: Comfy postaje službeni reseller komercijalnih licenci — !«メールアドレス», score 4, 2026-08-28. Izvorni članak: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3 je video model s otvorenim težinama objavljen u kolovozu 2026.; lokalno radi i na GPU-ovima klase RTX 3060 te generira 2K video s izvornim stereo zvukom. Comfy je postao prodajni posrednik za komercijalne licence (Professional/Enterprise), a Enterprise omogućuje uporabu i nedestiliranog modela.
  2. LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス», score 2, 2026-09-04. https://arxiv.org/abs/2609.03796 。Slikovni model s potpuno otvorenim receptom za treniranje, vrhunskim rezultatom na Qwen-Image-Benchu i brzom destiliranom turbo verzijom.
  3. Trellis.2 i Pixal3D izvorno integrirani u ComfyUI — !«メールアドレス», score 4, 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。Najavljeno je da su „najbolji otvoreni modeli za 3D generiranje” postali dio jezgre ComfyUI-ja.
  4. ComfyUI-MiniMaxH3-CLSS — !«メールアドレス», score 0, 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。Alat za MiniMax H3 koji omogućuje generiranje videa proizvoljne duljine sa zvukom i na potrošačkim računalima sa 16 GB VRAM-a.
  5. Fizgig LoRA/LoKR Studio — !«メールアドレス», score 4, 2026-08-30. https://github.com/shootthesound/Fizgig 。Otvoreni alat za treniranje i izdvajanje LoRA/LoKR adaptera za više obitelji modela, uključujući Krea 2, MiniMax i Klein 9B.
  6. VibeVoice-ComfyUI (Microsoftov otvoreni TTS integriran u ComfyUI) — !«メールアドレス», score 1, 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。Primjer uključivanja zvuka u radne tokove generiranja videa.
  7. Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», score 5, 2026-06-17. Lagani otvoreni temeljni slikovni model usmjeren na učinkovitost.
Zatvoreni modeli
  1. Midjourney se preusmjerava s AI generiranja slika na medicinske ultrazvučne skenere — !«メールアドレス», score 58, 2026-06-18. https://lemmy.zip/post/66397234 。Brojni povezani threadovi, uključujući Hacker News mirror s scoreom 40+, potaknuli su veliku raspravu pod nazivima „Midjourney Medical” i „Ultrasonic CT”. To je jedna od najvećih vijesti o zaokretu etablirane zatvorene usluge za slike.
  2. Midjourney od holivudskih studija zahtijeva detaljno otkrivanje uporabe AI-ja — !«メールアドレス», score 73, 2026-07-05. https://lemmy.today/post/56011946
  3. Izdan je Googleov novi slikovni model „Nano Banana 2 Lite” — !«メールアドレス», score 0, 2026-07-02. https://lemmy.world/post/48936394(hackernews mirror: https://lemmy.bestiver.se/post/1199483 )
  4. Microsoftov MAI-Image-2.5 približio se Googleovu Nano Banana 2 na benchmarkovima — !«メールアドレス», score 1, 2026-05-28. https://lemmy.durstig.online/post/35068
  5. Praktična usporedna recenzija Seedreama 5.0 Pro — !«メールアドレス», score 1, 2026-07-10. https://lemmy.durstig.online/post/46063
  6. Runway objavio da se poslovanje s poduzećima udvostručilo, uz neto zadržavanje prihoda iznad 300% — !«メールアドレス», score 0, 2026-08-30. https://lemmy.durstig.online/post/56937
  7. Googleova funkcija Earth AI tiho povučena dan nakon objave zbog problema s NSFW generiranjem — !«メールアドレス», score 1, 2026-08-07. https://lemmy.durstig.online/post/52162
Signali
  • Strana otvorenog koda puna je MiniMaxa H3: gotovo polovica objava zajednice stable_diffusion krajem kolovoza i početkom rujna 2026. odnosi se na proširenja ComfyUI-ja i alate za MiniMax H3: lokalni video, rad na RTX 3060 klasi i zvuk. Model se doima kao da postaje de facto standard za otvoreno generiranje videa.
  • Granica između otvorenog i zatvorenog postaje mutna: MiniMax H3 ima otvorene težine, ali se komercijalna uporaba naplaćuje licencama preko Comfyja. Model „besplatno za uporabu, ali plaćeno za komercijalne svrhe” znak je hibridnog pristupa koji može postati uobičajen.
  • Najveća vijest zatvorenih modela je „povlačenje”: vijest da Midjourney prelazi s generiranja slika na medicinske uređaje, tj. da se jedan od velikih zatvorenih igrača preusmjerava na potpuno drugo poslovanje, dobila je daleko viši score (58–73) od utrke novih modela.
  • 3D generiranje ulazi u ComfyUI: otvoreni modeli za pretvaranje teksta/slike u 3D, poput Trellisa.2 i Pixal3D-a, postaju dio jezgre ComfyUI-ja. Lokalni radni tokovi sada obuhvaćaju ne samo slike i video, već i stvaranje 3D resursa.
  • Lemmy u cjelini nema veliku specijaliziranu zajednicu za AI generiranje slika/videa: razgovori su raštrkani između tehnički orijentiranih Stable Diffusion zajednica s nekoliko tisuća članova i malih bot zajednica poput ai_reddita s 50 članova.
Ograničenja
  • Lemmy je federirana mreža, a API za pretraživanje obično obuhvaća samo indeks jedne instance: API pretraga lemmy.world propušta objave drugih instanci poput lemmy.dbzer0.com i lemmy.today. U ovom su istraživanju provjerene API-je i pretrage više instanci, ali rezultat nije potpun.
  • Zajednica localllama na lemmy.ml vratila je 404 pri izravnom dohvaćanju podataka o zajednici (/api/v3/community), pa detalji nisu mogli biti potvrđeni.
  • !«メールアドレス» je bot zajednica koja mehanički prenosi Redditov RSS. Ima 50 pretplatnika i gotovo bez ljudske rasprave; može služiti kao izvor vijesti, ali nije pokazatelj rasprave unutar Lemmyja.
  • Izravne pretrage zatvorenih video usluga na Lemmyju, poput Sora, Kling AI, Veo i Runway Gen, gotovo su uvijek vraćale nepovezane objave o mjestima, ljudima ili aktualnim vijestima. Nisu pronađene konkretne rasprave; za Runway je pronađena samo jedna objava o poslovnim rezultatima.
  • Opseg objava malen je u usporedbi s Redditom: scoreovi su uglavnom jednocifreni ili u desecima. Lemmy sam po sebi nema dovoljnu bazu da bi se trendovi opisali nakon čitanja 20 objava. Ovdje je korišteno sedam različitih upita kroz više instanci, a od pronađenih stvarnih objava odabrani su reprezentativni primjeri.

Pinterest

Pinterest — Vijesti o AI-ju za generiranje slika i videa

Vizualne teme
  • Stil „YouTube thumbnaila / naslovne slike bloga” uvjerljivo je najčešći. Tamne do tamnoplave pozadine s neonskim plavim, ljubičastim i narančastim gradijentima te vrlo debelim sans-serif naslovima poput „AI NEWS”, „THE FUTURE IS AI”, „BREAKING NEWS” i „AI IS CHANGING EVERYTHING!”. Češće se radi o naslovnicama članaka i videa o AI-ju nego o samim generiranim sadržajima [2, 7, 11, 38, 39, 42, 48]
  • Ljudska lica i portreti središnji su motiv. Animacija izraza, sinkronizacija usana, rekreiranje lica (Microsoft VASA-1) i AI portretne fotografije (ChatGPT+Higgsfield) ponavljaju se kao prikazi slučajeva uporabe „pokreni/stvori lice” [13, 14, 18, 23, 50]
  • Vizuali humanoida i robota često služe kao simbol općeg AI-ja. Česte su generičke stock slike bijelog robotskog profila ili žene kiborškog izgleda, bez veze s konkretnim alatom [2, 39]
  • Mreže „prije/poslije” i „jedna ulazna slika → više stilova”. Usporedbe pretvaraju stvarni video u drvo, origami, Lego kocke ili buket cvijeća, vjerojatno alatima iz Luma obitelji, te kompozicije plišanih likova u realističnim pozadinama [3, 31]
  • Infografike usporedbi i rang-lista alata. Ističu se popisi logotipa, usporedbe „Best Quality (Paid) vs Best Free” i tablice funkcija s kvačicama, namijenjene lakšem odabiru alata [7, 37]
  • Sličice s licima stvarnih poznatih osoba. AI-generirani portret nalik Jeffu Bezosu, voditelj u stilu bradatog YouTubera uz „AI NEWS” te fotografija predavanja Nvidijina Jensena Huanga upotrebljavaju se za privlačnost i dojam vjerodostojnosti [11, 36, 40]
  • Preklapanje mreže lica / wireframea. Marketinške slike prikazuju mrežaste linije i brojčane oznake preko lica i vrata, evocirajući analizu izraza i biometriju [23, 50]
  • Ujednačena paleta boja. Tamna podloga s neonskim akcentima cijan, magenta i žute gotovo je zajednički vizualni jezik pinova povezanih s AI alatima [2, 7, 38, 39, 42]
Istaknuti pinovi
  1. [1] Image to Video AI: How It Works and Why It Matters — naslovna slika objašnjavajućeg članka s dijagramom stvaranja „vremenske crte videa” iz jedne statične slike.
  2. [3] Google announces ultra-high quality video... (u stvarnosti demonstracija prijenosa stila s očuvanjem identiteta, nalik Luma alatima) — mreža 3×5 koja izvorni video pretvara u drvo, origami, Lego i cvijeće. Jasna demonstracija mijenjanja teksture uz očuvanje iste osobe i automobila.
  3. [7] 6+ Best AI Video Generation Websites — infografika za spremanje koja uspoređuje šest alata — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI i Hailuo AI — po funkcijama, ciljanim korisnicima i dostupnosti besplatnog plana.
  4. [10] Veo 2 — promotivni pin za Googleov VideoFX: fotorealistični kadar osobe koja gleda kroz mikroskop, plivač pod vodom i animirana žena koja pleše sa zviježđima, sažeti na jednoj slici.
  5. [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — promotivna slika koja prikazuje da Gemini API omogućuje stvaranje videa iz slike i naglašava izvorni zvuk.
  6. [23] Microsoft Unveils VASA-1 — tehnologija koja od jedne fotografije, zvučnog isječka i proizvoljnih kontrolnih signala stvara izražajan video osobe koja govori gotovo u stvarnom vremenu. Sličica prikazuje lica više etničkih skupina i izraza.
  7. [27] ShengShu Technology Unveils Vidu S1 — najavni pin za Vidu S1 kineske tvrtke ShengShu Technology, koji naglašava „generiranje u stvarnom vremenu i interaktivno generiranje”, uz vizual lika u cyberpunk stilu.
  8. [31] Google announces video generation AI 'Veo 3' — četiri izlaza koji ulaznu sliku plišane ljubičaste čudovišne igračke uklapaju u realističnu server-sobu, podvodne ruševine i grad od slatkiša.
  9. [33] 'Amuse 3.0', an AI art creation tool — najava nove verzije AMD-ova lokalnog alata za generiranje slika, temeljenog na Stable Diffusionu. Među uglavnom zatvorenim modelima to je jedan od rijetkih konkretnih signala lokalnog / otvorenijeg pristupa.
  10. [42] Breaking News Latest AI Developments — sažetak triju vijesti: agentske funkcije Groka 4.6, Gemini s milijardom korisnika i 150 milijuna generiranih slika dnevno, te Honorov AI robot telefon (datirano 2026-08-12).
Signali
  • Zatvoreni modeli izrazito su prisutni. Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6 i Gemini s milijardom korisnika izravno postaju teme pinova velikih tvrtki. Nasuprot tomu, specifična imena tipičnih otvorenih projekata — Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo i LTX — gotovo se uopće ne pojavljuju; iznimka je [33], Amuse 3.0, AMD-ov lokalni alat. Pinterest je vjerojatno više usmjeren na sažetke i usporedbe za opće korisnike i marketinške publike nego na tehničku zajednicu.
  • Usmjerenost na stvaranje i pokretanje lica. Sinkronizacija usana, reprodukcija izraza, zamjene za portretno fotografiranje i AI videi nalik voditeljima vijesti opetovano se pojavljuju. To vjerojatno odražava presjek Pinterestove potražnje — ljepota, samoprezentacija i ideje za društvene mreže — s marketingom AI videa.
  • Sekundarni sažeci prevladavaju nad primarnim izvorima. Češće su sličice s licem komentatora i naslovnim tekstom te infografike usporedbi nego snimke stvarnih izlaza modela. Pinterest više djeluje kao ulaz prema blogovima, YouTube videima i affiliate člancima nego kao mjesto širenja primarnih najava.
  • Signal odsutnosti: u pregledanom uzorku nisu pronađeni pinovi koji spominju japansko govorno područje ili tvrtke, primjerice japanske AI startupove i domaće usluge za generiranje videa. Gotovo sav sadržaj usmjeren je na alate i vijesti s engleskog govornog područja.
Ograničenja
  • Od 50 stavki u output/pinterest.pins.md, stvarno su otvorene i pregledane 24 slike odabrane radi reprezentativnosti. Za preostalih 26 provjereni su samo naslovi; pretpostavlja se da pripadaju istim obrascima — infografikama, portretima i usporedbama alata.
  • Osam pinova nema naslov, označeni su kao „(untitled)” ([12, 19, 20, 30, 35, 39, 46, 50]). Od njih su pregledani [39] i [50], dok ostali nisu.
  • Podaci koje je radnik unaprijed prikupio nemaju podjelu po žanru (pinterest.pins.md je jedan ravan popis), pa nije izrađen pregled po žanrovima.
  • Pinterest se u ovoj fazi nije izravno pregledavao; analiza se, prema uputama playbooka, temelji samo na slikama i naslovima koje je radnik unaprijed prikupio. Podaci ne sadrže metrike angažmana pinova poput lajkova, spremanja ni komentara.

Preporučene radnje

  • Ponovno pokrenite X pretragu s izričitim nazivima modela/alata (Stable Diffusion, ComfyUI, Flux, Wan, Kling, Sora), umjesto oslanjanja na popis trendova.
  • Izradite stalni popis poznatih Bluesky računa za provjeru putem getAuthorFeeda, jer je app.bsky.feed.searchPosts u ovom krugu vraćao 403.
  • Hibridne modele otvorenog i komercijalnog pristupa, poput MiniMaxa H3, izrijekom označite umjesto da ih stavljate u samo jednu kategoriju otvorenog koda.
  • Uvedite stalno praćenje velikih zaokreta i gašenja dobavljača, poput Midjourneyjeva medicinskog zaokreta i kraja Sora API-ja, jer su nadmašili čiste vijesti o lansiranju proizvoda na Redditu i Lemmyju.
  • Pinterest tretirajte kao pokazatelj raspoloženja potrošača, a ne kao tehnički primarni izvor, s obzirom na gotovo potpuno odsustvo pokrivenosti otvorenog koda.

Prikupljene slike

AI od slike do videa: kako radi i zašto je važan - The Data Scientist🎨 AI stvaranje slika i videaGoogle najavljuje video iznimno visoke kvalitete...Brige oko AI sadržaja i društvenih mrežaVrhunska AI platforma za generiranje slika i videa - The Data ScientistKoncept AI stvaranja sadržaja s ikonama za tekst, sliku, glazbu i videoSamo odradi kako treba 🎥AI od slike do videa – animirajte fotografije s pomoću AI-jaAI video stvaranje sadržaja: korisnici s visokim prihodima,...Google predstavlja Veo 2: napredni AI alat za generiranje videa s većim realizmom i filmskim značajkamaAI vijesti: OpenAI je napokon objavio ono što smo tražilislikaIzradite fotorealistične AI portretne fotografije sebe uz ChatGPT + Higgsfield 📸🤖Veo 3 od slike do videa: brzo generiranje i izvorni zvuk putem Gemini API-ja10 najboljih alata za sinkronizaciju usana (2026.) – najbolji AI softver za realističan video sinkronizacije usanaNajbolji AI generatori videa 2025.AI za generiranje slika i videa‎🚨 AI postaje zastrašujuće dobar.slikaslikaAI analiza slika i videaViše od 20% YouTubea sada je AI-generiranoMicrosoft predstavlja VASA-1 i postavlja nove standarde generativnog AI-ja za videoAI-generirani videozapisi: dobri ili loši? Evo istine! 🤖🎥AI alatiŠto je Imagvio AI i kako pomaže kreatorima...ShengShu Technology predstavlja Vidu S1 i donosi generiranje u stvarnom vremenu u AI videoOvladavanje videom i AI-jem: ključni trendovi marketinga na društvenim mrežama 2025.„Pretvorite svoju viziju u personalizirane AI 4K videozapise 🎥✨”slikaGoogle najavljuje AI za generiranje videa „Veo 3”,...povijest generativnog AI-ja„Amuse 3.0”, alat za stvaranje AI umjetnosti koji uključuje...AI vijesti ovog tjedna - 15. kolovoza 2026.slikaIzradit ću objašnjavajući AI video sa synthesia sora ai kling ai runway ai invideo🚀10 najboljih AI alata za slike i video u 2026. | Usporedba besplatnih i plaćenih AI alataAI vijesti i najnovija ažuriranja | Trendovi i proboji umjetne inteligencijeslikaNvidia #NOVI AI alati 🤯 #news #ai #openai #chatgpt #highlights #shortsRast tržišta AI generatora videa 2025.–2032.: preobrazba budućnosti stvaranja videa 🎥🤖Najnovije AI vijesti - Grok 4.6, Gemini 1B, Honor Robot PhonePretvorite ideje u zadivljujuće vizuale! 🎥Profesionalna AI video produkcija | filmski AI videozapisi | prilagođeno uređivanje videaAI generiranje slikaslikaGeneriranje videa 📹„Zašto AI chatbotovi ne uspijevaju pratiti najnovije vijesti”Kako izraditi kanal vijesti s AI-jem || AI generator video vijesti || AI sinkronizacija usanaslika

Napomena o kvaliteti podataka

X i Bluesky znatno su podbacili u odnosu na prag od približno 20 objava po platformi iz briefa (X je pokazao samo četiri tematske objave, sve o zatvorenim modelima; Blueskyjev API za pretraživanje vraćao je 403, pa se pokrivenost temeljila na poznatim računima). Reddit, Lemmy i YouTube također su prikupili manje stavki od ciljanog broja, a YouTube zbog JavaScript prikaza stranica nije mogao potvrditi broj pregleda ni pretplatnika.

Galerija