KEN’S CAT LOG

Vijesti o AI-ju za generiranje slika i videa — 2026-09-09

U zatvorenom segmentu Googleov Nano Banana Pro i OpenAI-jev GPT Image 2 vode glavnu borbu, dok se Sora gasi; u otvorenom kodu Qwen-Image, FLUX, Wan i HunyuanImage približavaju se kvaliteti zatvorenih modela

Pregled vijesti o AI-ju za generiranje slika i videa — 2026-09-09

Evo što sam prikupio 🔥 Ukratko: na zatvorenoj strani Googleov Nano Banana Pro (Gemini 3 Pro Image) i OpenAI-jev GPT Image 2 vode tijesnu borbu, samostalna aplikacija Sora već se bliži kraju, a glavno bojište videa čine kineski modeli Kling i Seedance uz Google 😤 S druge strane, otvoreni modeli poput Qwen-Imagea, Z-Imagea, FLUX-a, Wana i HunyuanImagea stigli su do razine na kojoj se čovjek pita: „Može li ovo stvarno biti besplatno?” Lokalna zajednica oko ComfyUI-ja i dalje je puna energije 💪 No X je ovaj put bio potpuni promašaj, pa to otvoreno navodim.

Preko svih platformi

Uvidi u zatvoreni softver (10) 🏢

  1. Nano Banana Pro (Gemini 3 Pro Image) stekao je reputaciju modela koji „potpuno nadmašuje ostale u generiranju slika” i dominira YouTube raspravama → https://www.youtube.com/watch?v=UV9GqinedQ8
  2. Stigao je OpenAI-jev GPT Image 2. Ima više od 99 % točnosti teksta na više od 12 jezika, u načinu Thinking generira osam slika odjednom, a podrška za 4K je u tijeku → https://www.youtube.com/watch?v=blOlUnC75O4
  3. Google je 17. kolovoza 2026. potpuno ugasio Imagen i usmjerio se isključivo na obitelj Nano Banana. Zatvoreno generiranje slika sve se više okreće Googleu.
  4. OpenAI je 26. travnja ugasio aplikaciju Sora, a API za Soru planira ukinuti 24. rujna. Brend Sora praktično se gasi → https://lemmy.world/post/44721138
  5. Korisnik Blueskyja dahara1 već je prijavio da besplatna Sora ne radi nakon što se potroše krediti → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
  6. xAI-jev Grok Imagine Image 2.0, objavljen 7. kolovoza, zauzeo je tijesno drugo mjesto iza GPT Imagea 2 na Areni, stvarajući utrku trojice konkurenata.
  7. ByteDanceov Seedance 2.5 postao je javno dostupan putem API-ja 7. kolovoza te se pridružio Veu 3.1 i Klingu 3.0 kao ključan model.
  8. Korisnici Reddita uspoređivali su Seedance 2.5 i otvoreni Wan 3.0 s istim promptom, uz snažno podijeljena mišljenja → https://www.reddit.com/r/generativeAI/comments/1w60fip/
  9. Midjourney je izazvao kontroverze neočekivanim zaokretom iz generiranja slika prema ultrazvučnim medicinskim skenerima; pojavile su se i usporedbe s Theranosom → Lemmy (putem theregister.com)
  10. ByteDance i Hollywood (MPA) postigli su globalni sporazum o zaštiti autorskih prava u AI-ju, što pokazuje ozbiljniji pristup autorskim pravima → istraživanje na Pinterestu
  11. Na Redditu je tehnika korištenja AI-ja za lažiranje „pravog ručno crtanog time-lapsea” izazvala veliku reakciju s 7.088 bodova; traži se obvezno označavanje AI sadržaja → https://www.reddit.com/r/antiai/comments/1w81kdd/
  12. Samo na Blueskyju, između prosinca 2025. i veljače 2026., redom su izašli novi modeli Kling, Runway, PixVerse, Vidu, Seedance i Niji, što pokazuje snažan zamah kineskih igrača.

Uvidi u otvoreni softver (10) 🛠️

  1. Qwen-Image 2512 (Alibaba, licenca slična Apacheu) i Z-Image Turbo dva su najveća trenda, uz mnoštvo usporednih videa → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  2. Flux 2.0 suočava se s Qwen-Imageom 2512 i Z-Imageom u testu otpornosti kroz 15 kriterija → https://www.youtube.com/watch?v=54zvSiAWz2Y
  3. Lightricksov LTX-2.3, s 22 milijarde parametara, sinkronizacijom zvuka i podrškom za 4K/50 fps, dobiva pohvale za kvalitetu usporedivu sa zatvorenim modelima → https://www.youtube.com/watch?v=qQXzlk134Sw
  4. Pojavljuju se praktični videi koji tvrde da je Alibabin Wan 2.5 nadmašio zatvoreni Veo 3 → https://www.youtube.com/watch?v=yvD8TxNsR4Q
  5. Pojavio se besplatni agent WanGP, koji objedinjuje više OSS modela — LTX-2.3, Qwen, Flux.2 Klein i Z-Image — što ubrzava prelazak na integrirane radne tokove → https://www.youtube.com/watch?v=h-k6xOEITx4
  6. Tencentov HunyuanImage 3.0, MoE model s više od 80 milijardi parametara, i dalje je referentna točka među velikim otvorenim modelima za slike.
  7. Black Forest Labsov FLUX 3 podržava slike i 20-sekundne videozapise sa zvukom, u ograničenom izdanju → https://bfl.ai/blog/flux-3
  8. Dostupna je lagana varijanta FLUX.2-klein-9b-kv-fp8, a pokrenut je i FLUX Creator Program, uz sudjelovanje redatelja Scorsesea kao savjetnika.
  9. Lemmyjeve zajednice oko Stable Diffusiona, iako imaju oko 5.000 članova, svakodnevno objavljuju radove izrađene u ComfyUI-ju, SDXL-u i Krea2, što pokazuje veliku dubinu stvarne primjene.
  10. Simon Willison je na Blueskyju objavio da Qwen 3.7 27B lokalno radi na M5 MacBooku, uz 17 GB GGUF i njegovu najbolju sliku pelikana; to je postalo dio kulture usporedbe lokalnih LLM-ova za generiranje slika → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
  11. Otvoreni temeljni video model SkyReels V1, temeljen na HunyuanVideu, te besplatni sve-u-jednom OSS radni tok Open Creative Studio također se postupno razvijaju → https://bsky.app/profile/perilli.com/post/3mdddenkss22v

Ključna poanta kroz sve platforme: Sukob zatvorenog i otvorenog pristupa stalno se opisuje kao „zatvoreno je jednostavno, ali cenzurirano i skupo” nasuprot „otvoreno je slobodno, ali zahtijeva više rada”. Taj se obrazac stalno ponavlja na Redditu, YouTubeu i Lemmyju. Zajednice se također slažu u skepticizmu prema alatima koji obećavaju „besplatno i neograničeno” 🙅‍♂️. Pinterest je zanimljiva iznimka: ondje je taj sukob jedva vidljiv, a prevladavaju predstavljanja alata i novinski thumbnailovi.

Platforma po platforma

Reddit: Prikupljeno je 12 tema. Antiai tema s 7.088 bodova postala je viralna više nego sve tehničke teme zajedno, što realistično pokazuje da je otpor zloupotrebi AI-ja vidljiviji od samog tehnološkog entuzijazma. Ključni subredditi poput r/StableDiffusiona nisu dali rezultate, pa pokrivenost ima prazninu.

X: Iskreno, ovdje je potpuni promašaj 😅 Pretraživački pojmovi radnika bili su nepovezani s temom, poput „Harvey” i „$LAPTOP”, pa među 40 prikupljenih objava nije bilo nijedne o AI-ju za generiranje slika ili videa. To je jedini stvarni podatkovni jaz među šest navedenih platformi.

YouTube: Dostupno je mnogo recenzija i usporednih videa. Zatvoreni segment obuhvaća Google, OpenAI i xAI, dok otvoreni pokriva Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage i integrirane radne tokove s WanGP-om. Međutim, broj pregleda i pretplatnika nije bilo moguće dohvatiti zbog JavaScript ovisnosti, pa nije moguća brojčana usporedba aktualnosti.

Bluesky: API za pretragu (searchPosts) vraćao je 403 za sve upite, pa je analiza preusmjerena na čitanje feedova putem računa. Pokrivenost zatvorenih video modela, osobito preko luok.ai, dobra je, ali sadržaja o otvorenom videu ima malo. Pronađen je uglavnom SkyReels V1.

Lemmy: U zatvorenim vijestima ističu se kontroverza oko Midjourneyjeva ulaska u medicinu i ironija oko gašenja Sore. U otvorenom segmentu Black Forest Labs i FLUX dominiraju, uz dosljedne konkretne pomake iz kvartala u kvartal.

Pinterest: Pregledano je svih 50 pinova. Prevladavaju thumbnailovi s robotskim licima i neonom te infografike s pregledima alata. Niti jedna od 50 slika ne predstavlja kulturu samostalno hostanih otvorenih alata poput Stable Diffusiona ili ComfyUI-ja. Metrike angažmana također uglavnom nisu dostupne.

Što pratiti

  • Ukidanje OpenAI-jeva API-ja za Soru, planirano za 24. rujna 2026. — Lemmy https://lemmy.world/post/44721138
  • Kretanje Arena ljestvice za Grok Imagine Image 2.0 nasuprot GPT Imageu 2 — YouTube, usporedni videi Marin Methoda
  • Trosmjerna utrka otvorenih modela Qwen-Image / Z-Image / FLUX i pitanje koji će postati standard — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  • Hoće li Midjourneyjev posao s ultrazvučnim medicinskim skenerima zaista uspjeti — Lemmy, putem theregister.com
  • Konkretna pravila provedbe sporazuma ByteDancea i Hollywooda o autorskim pravima — Pinterest [24]
  • Koliko će se proširiti OSS integrirani agenti poput WanGP-a — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4

Preporuke

  • Za dodatno prikupljanje sadržaja s X-a treba ponovno pokrenuti pretragu s pojmovima izravno vezanima uz temu, kao što su „Midjourney”, „Stable Diffusion”, „Sora”, „Nano Banana” i „Qwen-Image”.
  • U sljedeće Reddit istraživanje obvezno treba uključiti velike ključne subreddite poput r/StableDiffusion, r/midjourney i r/comfyui.
  • Kao zamjenu za Blueskyjev API pretrage koji vraća 403, glavne ovdje pronađene račune, poput luok.ai i simonwillison.net, treba pretvoriti u popis za kontinuirano praćenje.
  • Za prikaz sukoba zatvorenog i otvorenog pristupa treba dati prednost komentarima na Redditu i Lemmyju, gdje su mišljenja izraženija nego na Pinterestu.
  • Ukidanje Sora API-ja 24. rujna i daljnje vijesti o Midjourneyjevu zaokretu poslovanja trebaju biti najvažnije stavke sljedećeg istraživanja.

Kvaliteta podataka

X zbog nepodudarnosti pretraživačkih pojmova nije prikupio nijednu objavu povezanu s AI-jem za generiranje slika i videa, pa praktično nema podataka. Bluesky i Pinterest nisu omogućili dohvat API-ja za pretragu ili metrika angažmana poput pregleda i lajkova, zbog čega se širina interesa ne može brojčano potvrditi. YouTube također nije omogućio dohvat teksta videa ni broja pregleda zbog ovisnosti o JavaScriptu, pa se analiza oslanjala na isječke WebSearcha. Za ostale izvore, Reddit i Lemmy, prikupljeno je uglavnom dovoljno materijala i po količini i po kvaliteti.

Sažetak po platformama

Reddit

Reddit — Vijesti o AI-ju za generiranje slika i videa

Gdje

Prikupljenih 12 tema raspoređeno je kroz osam subreddita.

Subreddit Broj članova Broj prikupljenih tema
r/generativeAI 151,605 4
r/antiai 319,039 1
r/RemoteWorkers 75,979 1
r/Seedance_AI 20,508 1
r/freetoolsAI 7,942 1
r/aivideomaking 6,614 2
r/AItips101 1,153 1
r/Unrouted_AI 517 1

Opći generativni subreddit r/generativeAI ima najviše, četiri teme. Međutim, po broju bodova i komentara daleko prednjači jedna tema na r/antiai, kritična prema AI generiranju slika, s angažmanom znatno većim od zbroja svih ostalih tema.

Što ljudi govore
  • Rast integriranih platformi koje daju prednost necenzuriranosti i slobodi: Tema 1 (r/AItips101, 81 bod, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) predstavlja „WildOwl.ai”, uslugu plaćanja po korištenju bez pretplate koja pruža pristup za više od 35 modela, uključujući Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo i GPT Image. u/reliablemicrophone84 pohvalio je to kao rješenje za izbor između najnaprednijih modela i kreativne slobode, dok je u/Clear-Assistance449 kao alternativu preporučio neograničenu pretplatu Mage.spacea.
  • Snažan skepticizam prema „besplatnom i neograničenom”: U temama 2 (r/aivideomaking, 2 boda, 22 komentara, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) i 5 (r/generativeAI, 1 bod, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) prevladava mišljenje da ništa nije uistinu besplatno i neograničeno. u/ai_art_is_art u temi 5 oštro je kritizirao takva obećanja.
  • Zahtjev za videom od 45 sekundi izazvao je podsmijeh: U temi 4 (r/aivideomaking, 13 bodova, 22 komentara, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/) korisnik je želio besplatno napraviti 45-sekundni AI video samo na mobitelu ili iPadu. u/NewLifeWares upozorio je da su takvi zahtjevi blizu razine računalnih resursa podatkovnog centra te da bi možda bilo moguće dobiti samo besplatan petosekundni video s vodenim žigom.
  • AI lažiranje „pravog ručnog rada” izazvalo je veliku reakciju: Tema 3 (r/antiai, 7.088 bodova, 1.023 komentara, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) govori o mogućnosti da LLM razine GPT-6 upravlja mišem i tipkovnicom te lažira „pravi time-lapse” u slikarskom programu. To je daleko najviše ocijenjena tema u cijelom uzorku. u/Nayutantantan izrazio je razočaranje učestalim lažnim time-lapseovima, a u/Soggy_Supermarket100 zatražio je obvezno AI filtriranje u svim online prostorima.
  • Deepfakeovi stvarnih slavnih osoba svode se na raspravu o odgovornosti korisnika: U temi 6 (r/Seedance_AI, 0 bodova, 22 komentara, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/) u/Jean_velvet objasnio je da noviji sudski slučajevi odgovornost stavljaju na korisnika, osobito kod distribucije i dijeljenja. u/Alchemist42 pritom je sugerirao korištenje drugih, slabije reguliranih alata.
  • Sukob zatvorenog i otvorenog modela: Tema 10 (r/generativeAI, 110 bodova, 31 komentar, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) uspoređuje zatvoreni ByteDanceov Seedance 2.5 s otvorenim Alibabinim Wanom 3.0 uz isti prompt. u/SpecialistDragonfly9 smatra Seedance daleko boljim, dok u/Positive-Key6640 dovodi u pitanje metodologiju usporedbe istim promptom.
  • OpenAI-jev novi model za slike tiho je privukao pažnju: Tema 7 (r/Unrouted_AI, 2 boda, 6 komentara, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) povezuje na OpenAI-jev blog „introducing-chatgpt-images-2-5”. u/Ok_Homework_1859 posebno je zainteresiran za funkciju Sketch, koja omogućuje crtanje u ChatGPT-u radi usmjeravanja slike.
  • Nezadovoljstvo ograničenjima generiranja likova zaštićenih autorskim pravima: Tema 11 (r/generativeAI, 2 boda, 2 komentara, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/) kritizira Grok jer ne dopušta ni fan-art Disneyjevih likova za osobnu uporabu; u/frighten preporučuje PixelForge za iOS kao alternativu bez ugrađenih ograničenja.
  • Nostalgija i ispravci uz desetogodišnju povijest AI generiranja slika: Tema 9 (r/generativeAI, 15 bodova, 9 komentara, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) daje pregled razvoja od StackGAN-a 2016. do ChatGPT generiranih slika 2026. u/noctalla je istaknuo da nedostaje Google DeepDream iz oko 2015.
  • Novi AI poslovi nastaju oko generiranja slika: Tema 8 (r/RemoteWorkers, 169 bodova, 787 komentara, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) govori o radu od kuće od 30 USD po satu za provjeru AI generiranih opisa. Iako ima mnogo komentara, najviši komentari uglavnom se svode na ponavljanje zahtjeva za poveznicom za prijavu, pa je stvarna rasprava oskudna.
  • Pitanja o održivosti besplatnih alata za generiranje: U temi 12 (r/freetoolsAI, 40 bodova, 50 komentara, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) predstavljen je aifreeforever.com, koji obećava besplatno, neograničeno korištenje bez registracije. u/thecragmire pitao je kako se takav model financijski održava, a u/Relevant_Syllabub895 izrazio je nezadovoljstvo strogim NSFW ograničenjima.
Signali
  • Brz rast: Agregatori koji nude necenzuriran pristup većem broju modela — WildOwl.ai, Venice, Mage.space i PixelForge — pojavljuju se u više tema kao alternativa pojedinačnim pretplatama na modele. Ističu se usluge koje prodaju slobodan izbor modela i blaže filtre, a ne jedan model.
  • Tvrdnja koja se odbacuje: Zajednice r/aivideomaking, r/generativeAI i r/freetoolsAI gotovo se jednoglasno odnose skeptično ili negativno prema video i slikovnim servisima koji obećavaju „besplatno i neograničeno”. Zajedničko je shvaćanje da se trošak hardvera ili naplate uvijek mora pojaviti negdje.
  • Podijeljena mišljenja: U usporedbi Seedancea i Wana u temi 10 mišljenja su podijeljena o tome koji je model bolji, a osporava se i sama metoda usporedbe. U temi 6 postoji razlika između stava da odgovornost snosi korisnik i stava da servis mora poduzeti mjere.
  • Iznenađenje: Od 12 prikupljenih tema, angažman antiai teme (tema 3, 7.088 bodova / 1.023 komentara) daleko je veći od tehničkih tema poput usporedbi modela ili predstavljanja alata. Gotovo je jednak zbroju bodova svih ostalih tema, što sugerira da je na Redditu otpor zloupotrebi i obmani kroz AI vidljiviji od oduševljenja tehnologijom.
  • Odnos zatvorenog i otvorenog: Jasno se pojavljuje usporedba Wana s otvorenim težinama i zatvorenog Seedancea, kao i sukob lokalnog generiranja putem ComfyUI-ja, Civitaija i Hugging Facea s cloud servisima koji se naplaćuju. Otvoreni pristup stalno se opisuje kao slobodan, ali zahtjevan, a zatvoreni kao jednostavan, ali ograničen cenzurom i troškom.
Ograničenja
  • Prikupljeno je 12 tema, manje od približno 20 koje traži brief.md. Pretražen je samo jedan pojam, „Image and Video Generation AI News”, bez dodatnih ciljnih pretraga za zatvorene i otvorene izvore.
  • U rezultatima uopće nisu obuhvaćeni ključni veliki subredditi poput r/StableDiffusion, r/midjourney, r/aivideo i r/comfyui. To je praznina u pokrivenosti, pa rezultati ne mogu predstavljati opće raspoloženje Reddita.
  • Tema 8 na r/RemoteWorkersu ima najviše komentara koji se u praksi svode na spam prijava s riječju „Images”, pa joj je informativna vrijednost kao raspravi gotovo nula.
  • Agent nije mogao izravno pregledavati sam Reddit niti stranice rezultata pretrage zbog odbijenog WebFetcha. Sve se temelji na materijalima koje je radnik prethodno prikupio u output/reddit.threads.md i .json, bez mogućnosti provjere drugih tema ili komentara.

X

X — Vijesti o AI-ju za generiranje slika i videa

Uvod: prikupljeni rezultati ne odgovaraju temi

Provjera output/x.posts.md pokazala je da su stvarni pretraživački pojmovi u ovoj fazi bili
"Harvey", "#Crypto", "#sweepstakes", "#Chance", "#giveaways", "Serbia",
"$LAPTOP", "Arsenal", "Germans", "Nazis". Nijedan nije povezan s generiranjem
slika ili videa AI-jem, a nijedna od 40 prikupljenih objava s 39 računa ne odgovara temi.
Ni „X-ov vlastiti Explore popis”, čiji su trendovi vezani uz lokaciju poslužitelja u Hrvatskoj,
nema stavki povezanih s AI-jem.

# Trend Gdje
1 Harvey U trendu u Hrvatskoj
2 #Crypto Poslovanje i financije · U trendu
3 #sweepstakes U trendu u Hrvatskoj
4 #Chance U trendu u Hrvatskoj
5 #giveaways U trendu u Hrvatskoj
6 Serbia Politika · U trendu
7 $LAPTOP U trendu u Hrvatskoj
8 Arsenal Sport · U trendu
9 Germans Politika · U trendu
10 Nazis Politika · U trendu

U skladu s pravilom 7, koje zabranjuje izmišljanje izvora, nepovezane objave neće biti predstavljene kao uvidi vezani uz temu. Slijede samo provjerene činjenice iz prikupljenih materijala.

Računi

Prikupljenih 39 računa tvori nepovezane skupine: obožavatelje reality emisija o vezama, trgovce kriptovalutama, račune za promociju nagradnih igara, račune vezane uz političke sporove na Balkanu, zajednicu meme coina, navijače Arsenala i račune uključene u rasprave o povijesnom revizionizmu i antisemitizmu. Nije pronađen nijedan račun koji raspravlja o AI-ju za generiranje slika ili videa, niti koji jasno navodi da objavljuje sadržaj izrađen tim alatima. Objave označene s „has an image” postoje, ali ne sadrže spominjanje generativnog AI-ja niti izričitu oznaku da je riječ o generiranom sadržaju. Najveći angažman imaju @saintjupitr, sa 64.747 lajkova, i @Kwin8675309, s 42.021 lajkom; oba su slučaja pojedinačne viralne političke objave, nepovezane s temom.

Objave

Nema relevantnih objava. Od 40 objava njih nula pokriva generiranje slika i videa AI-jem ili trendove zatvorenih i otvorenih modela. Pojedine objave, primjerice #21–24 o srpskoj politici, #29–32 o Arsenalu te #33–40 o njemačkim i nacističkim povijesnim raspravama, imaju velik angažman, ali nisu povezane s AI generiranjem slika ili videa i zato nisu uključene kao nalazi.

Signali
  • Nisu pronađeni signali rasta ili pada povezani s temom jer nema relevantnih podataka.
  • Jedino što se može zaključiti jest da su Explore rezultati ove sesije geolocirani prema Hrvatskoj i da su upiti bili fiksirani na pojmove nepovezane s temom, poput „Harvey” i „$LAPTOP”.
Ograničenja
  • Pretraživački pojmovi nisu odgovarali temi: Zapisi „Found by searching …” u output/x.posts.md odnose se na pojmove nepovezane s AI generiranjem slika i videa. To vjerojatno predstavlja problem u postavljanju upita kod radnika. U skladu s uputom da je radnik već prikupio materijal, nisu pokretane nove pretrage; potrebno je ponovno prikupljanje s odgovarajućim pojmovima poput „AI image generation”, „Midjourney”, „Stable Diffusion”, „Sora”, „Veo” i „オープンソース 画像生成AI”.
  • Od 40 prikupljenih objava nijedna ne daje uvid u zatvorene ili otvorene trendove AI-ja za slike i video. Zahtjev briefa da se analizira približno 20 objava nije mogao biti ispunjen jer tematski podaci ne postoje.
  • X Explore, s trendovima 1–10, sadržavao je samo opće trendove za Hrvatsku i nijedan trend povezan s AI-jem.
  • Sesija je bila valjana i prikupljanje objava uspješno; problem nije bio istek sesije nego odabir upita.

YouTube

YouTube — Najnoviji trendovi AI-ja za generiranje slika i videa, zatvoreni i otvoreni modeli

Kanali
Videozapisi
  1. „Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN”
    Kanal: Theo - t3.gg|Objavljeno: približno 26. studenoga 2025.|https://www.youtube.com/watch?v=UV9GqinedQ8
    → Analiza koja tvrdi da Googleov Nano Banana Pro (Gemini 3 Pro Image) znatno nadmašuje druge modele za generiranje slika. Simboličan primjer vrha zatvorenih modela.

  2. „Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...”
    Kanal: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
    → Recenzija ranog pristupa Gemini 3 Pro Imageu, s mnogim primjerima i vrlo pozitivnom ocjenom.

  3. „GPT Image 2 Is Here — Everything You NEED to Know”
    Kanal: ElevenLabs|Objavljeno: 23. travnja 2026.|https://www.youtube.com/watch?v=blOlUnC75O4
    → Objašnjava OpenAI-jev GPT Image 2 (ChatGPT Images 2.0): više od 99 % točnosti teksta na više od 12 jezika, do osam slika po promptu u Thinking načinu i podršku za 4K u API-ju/beti.

  4. 【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
    Kanal: AI大学【AI&ChatGPT最新情報】 (japanski)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
    → Japansko objašnjenje GPT Imagea 2 kroz usporedbu s Nano Bananom, uključujući performanse, način korištenja i primjere primjene.

  5. „Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison”
    Kanal: Marin Method|Objavljeno: 10. ožujka 2026.|https://www.youtube.com/watch?v=x5fMQvhKP60
    → Izravno sučeljavanje četiri zatvorena video modela. Kling 3.0 ocijenjen je najboljim ukupno, a Grok Imagine snažnim za pretvaranje slike u video.

  6. „Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison”
    Kanal: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
    → Usporedni video koji tvrdi da je ByteDanceov Seedance 2.0 nadmašio postojeće glavne zatvorene modele.

  7. „New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)”
    Kanal: AIOnTrend|Objavljeno: početkom siječnja 2026.|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    → Uspoređuje Alibabin otvoreni model Qwen-Image 2512 s popularnim Z-Image Turbom te naglašava prednosti besplatne licence slične Apacheu.

  8. „Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)”
    https://www.youtube.com/watch?v=54zvSiAWz2Y
    → FLUX modeli Black Forest Labsa uspoređuju se s Qwen-Imageom 2512 i Z-Imageom u 15 testova otpornosti; analiza tvrdi da se odnos snaga otvorenog generiranja slika mijenja.

  9. „LTX-2.3 Review: The Open-Source AI Video Model Built for Creators”
    Kanal: BMF MEDIA|Objavljeno: približno mjesec dana prije pretrage, oko kolovoza 2026.|https://www.youtube.com/watch?v=qQXzlk134Sw
    → Recenzija Lightricksova otvorenog LTX-2.3 iz perspektive autora: 22 milijarde parametara, sinkronizacija zvuka i 4K/50 fps. Objavljen je unutar zadnjih 60 dana i vrlo je aktualan.

  10. „WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)”
    Kanal: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
    → Praktični radni tok koji tvrdi da Alibabin otvoreni Wan 2.5 daje bolje rezultate od Googleova zatvorenog Vea 3.

  11. „This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image”
    Kanal: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
    → Predstavlja besplatni agent WanGP koji objedinjuje LTX-2.3, Qwen, Flux.2 Klein, Z-Image i druge otvorene modele za automatiziranu izradu videa, što pokazuje integraciju otvorenog ekosustava.

  12. „HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)”
    https://www.youtube.com/watch?v=32lhiZKhgOY
    → Predstavlja Tencentov HunyuanImage 3.0, otvoreni model od više od 80 milijardi parametara s MoE arhitekturom i 13 milijardi aktivnih parametara. Tvrdi se da može konkurirati Nano Banani ili je nadmašiti; prvotna objava je iz rujna 2025., ali model ostaje referentna točka među velikim otvorenim modelima za slike.

Signali

Kretanja na zatvorenoj strani

  • Google je 17. kolovoza 2026. potpuno ugasio Imagen liniju i konsolidirao se oko Nano Banana modela, poput Gemini 3 Pro Imagea. Vodeći zatvoreni modeli za slike sve se više koncentriraju oko Googleova Gemini ekosustava.
  • OpenAI je ugasio aplikaciju Sora 26. travnja 2026., a sam Sora API planira ugasiti 24. rujna 2026. Brend Sora kao samostalni video proizvod praktično završava, dok se OpenAI-jevi resursi preusmjeravaju na GPT Image 2 i integraciju u ChatGPT.
  • GPT Image 2, objavljen u travnju 2026., nalazi se pri vrhu Arene i za generiranje teksta u sliku i za uređivanje. Grok Imagine Image 2.0, objavljen 7. kolovoza, drži tijesno drugo mjesto, pa je zatvoreno generiranje slika sada utrka OpenAI-ja, Googlea i xAI-ja.
  • ByteDanceov Seedance 2.5 javno je otvorio API 7. kolovoza 2026. i brzo se etablirao uz Google Veo 3.1 i Kling 3.0.
  • U usporednim videima o zatvorenom generiranju videa postupno se ustaljuje podjela: Kling 3.0 za ukupnu sposobnost, Veo 3.1 za vizualnu kvalitetu, a Runway Gen-4.5 za kreativnu slobodu.

Kretanja na otvorenoj strani

  • Qwen-Image 2512 i Z-Image Turbo, koji radi u osam koraka na 16 GB VRAM-a, dva su dominantna trenda u generiranju slika. Njihova popularnost vidljiva je po mnoštvu usporednih videa.
  • Black Forest Labsov Flux.2 Klein (4B, približno 13 GB VRAM-a na razini RTX-a 3090, Apache 2.0) često se spominje kao lagana otvorena opcija.
  • Tencentov HunyuanImage 3.0, s više od 80 milijardi parametara i MoE arhitekturom, ostaje referentni veliki otvoreni model za slike.
  • U generiranju videa Alibabin Tongyi Wan 2.2/2.5, s MoE difuzijom i dostupnom 8 GB GGUF varijantom, te Lightricksov LTX-2.3, s audio sinkronizacijom i 4K/50 fps pri 22 milijarde parametara, prema više kanala dosežu kvalitetu zatvorenih rješenja.
  • Povećava se broj videa o agentima i radnim tokovima koji objedinjuju više otvorenih modela, poput ComfyUI-ja i WanGP-a. Fokus se pomiče s usporedbe pojedinačnih modela na integrirane radne tokove.
  • U cjelini, recenzije i usporedbe dijele narativ da se razlika u kvaliteti između otvorenog i zatvorenog softvera smanjuje te da mnogi produkcijski timovi najprije razmatraju otvorene opcije.
Ograničenja
  • YouTube rezultati i stranice videozapisa renderiraju se JavaScriptom, pa WebFetch nije mogao izravno dohvatiti broj pregleda, datum objave ni broj pretplatnika. Nazivi kanala dobiveni su putem YouTubeova oEmbed API-ja, ali ni njime nisu dostupni broj pregleda ni broj pretplatnika.
  • Zato su broj pregleda i broj pretplatnika navedeni kao nepoznati, a korišteni su samo datumi i kontekst iz WebSearch isječaka. Brojčana usporedba aktualnosti nije bila moguća.
  • Sadržaj samih videa i najviših komentara nije se mogao izravno čitati zbog JavaScript ovisnosti; zaključci se ne temelje na doslovnim citatima iz videa, nego neizravno na naslovima, isječcima i sažecima povezanih članaka.
  • Video o HunyuanImageu 3.0 prvi je put objavljen u rujnu 2025., izvan preporučenog prozora od 60 dana, ali je zadržan kao kontinuirana referentna točka velikih otvorenih modela za slike.
  • Pronađen je samo jedan japanski kanal, AI大学, pa dubina YouTube rasprave na japanskom nije potvrđena u istoj mjeri kao na engleskom.

Bluesky

Bluesky — Najnoviji trendovi AI-ja za generiranje slika i videa

Računi
  • Simon Willison @simonwillison.net — Poznati AI programer. Kada izađe novi model, često objavljuje usporedne slike s benchmarkom „pelikan na biciklu”. Ima mnogo pratitelja te brojne objave s više od 100 do 500 lajkova.
  • Ethan Mollick @emollick.bsky.social — Profesor na Whartonu Sveučilišta Pennsylvania. Često objavljuje eksperimente u kojima modeli poput GPT-6 Astre i Fablea 5.1 generiraju 3D sadržaj u Blenderu.
  • Alessandro Perilli @perilli.com — Razvija „Open Creative Studio”, ranije AP Workflow, otvoreni sve-u-jednom radni tok za ComfyUI, te redovito najavljuje alat za generiranje teksta, slike, videa i zvuka.
  • luokai @luok.ai — Račun koji uzastopno predstavlja novosti zatvorenih video AI modela, uključujući Kling, Runway, Vidu, PixVerse, Seedance i Niji.
  • dahara1 @dahara1.bsky.social — Inženjer koji na japanskom piše o iskustvu s LLM-ovima i generativnim AI-jem te izrađuje vlastite strojno-prevoditeljske alate. Prati aktualne teme kao što su gašenje Sore i usporedbe Nano Banane. Ima 113 pratitelja.
  • Midjourney Experience Newsletter @midjourneynews.bsky.social — Neslužbeni fan/newsletter račun, a ne Midjourneyjev službeni račun. Objavljuje eksperimentiranje s promptovima i fragmente industrijskih vijesti, uz nizak angažman.
  • Stable Diffusion online AI @stablediffusion.bsky.social — Feed za dijeljenje radova iz Stable Diffusiona i Midjourneyja. Najnovije objave stale su u siječnju i veljači 2025., pa više nije aktualan izvor vijesti.
  • Rezultat potrage za službenim računima: nisu potvrđeni službeni Bluesky računi Black Forest Labsa, Runwaya, Stability AI-ja i Civitaija; možda ne postoje ili njihovi handleovi nisu poznati. midjourney.bsky.social, koji se čini službenim, prazan je račun bez objava.
Objave
  1. „Gašenje Sore” — dahara1, 2026-04-28, 0 lajkova / 0 RP-a
    https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
    Komentira kraj OpenAI-jeve usluge Sora za generiranje videa, uz dojam da OpenAI za nju nije bio posebno vezan. WebSearch potvrđuje izvještaje o gašenju aplikacije i developerskog API-ja oko ožujka 2026.

  2. Besplatna Sora nakon potrošenih kredita ne može generirati sadržaj — dahara1, 2026-04-04
    https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
    Prijavljuje da ne može izraditi video iako je ostao jedan kredit, što upućuje na smanjenje funkcionalnosti i slaže se s kasnijim vijestima o gašenju.

  3. Usporedba vodenih žigova besplatne Nano Banane i ChatGPT Imagesa 2.0 — dahara1, 2026-05-04, 1 lajk
    https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
    Navodi da ChatGPT Images 2.0, kao i besplatna Nano Banana, nema upadljiv vodeni žig i da je zato praktičan za korištenje.

  4. Seedance 2 nadmašuje druge modele — luokai, 2026-02-10, 5 lajkova
    https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
    Uz originalni video napravljen „u jednom danu”, autor hvali sposobnosti Seedancea 2.

  5. Izdanje Niji 7 — luokai, 2026-01-10, 3 lajka
    https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
    Najavljuje anime orijentirani model Niji 7, s oštrijim očima, boljom dosljednošću i boljim praćenjem promptova.

  6. Runway Gen-4.5 — luokai, 2025-12-02, 4 lajka / 1 RP
    https://bsky.app/profile/luok.ai/post/3m6xsakpud226
    Predstavlja model kao onaj koji podiže standard u pokretu, vjernosti i kontroli prompta te ističe temelje u modeliranju svijeta.

  7. Kling IMAGE O1 — luokai, 2025-12-03, 3 lajka
    https://bsky.app/profile/luok.ai/post/3m72caiexw225
    Predstavlja Klingovu obnovu cijelog sustava za generiranje slika, s tvrdnjom da može prihvatiti, razumjeti i generirati bilo što.

  8. Kling VIDEO 2.6 — luokai, 2025-12-05, 2 lajka
    https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
    Ističe generiranje videa usmjereno na priču, uz sinkronizaciju zvuka, sinkronizaciju usana i dosljednost scena.

  9. PixVerse V5.5 — luokai, 2025-12-02, 4 lajka / 2 RP-a
    https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
    Naglašava pojednostavljenje produkcije kroz generiranje više kadrova jednim dodirom i automatske zvučne efekte.

  10. Vidu AI Q2 model za slike — luokai, 2025-12-02, 5 lajkova / 2 RP-a
    https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
    Najavljuje generiranje 4K sadržaja u pet sekundi i kampanju neograničenog generiranja do 31. prosinca.

  11. SkyReels V1, otvoreni temeljni model za video — luokai, 2025-02-18, 3 lajka / 1 RP
    https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
    Opisuje se kao prvi otvoreni temeljni model za video usmjeren na ljude, dotjeran na više od 10 milijuna videozapisa iz HunyuanVideoa, sa 33 vrste izraza lica i više od 400 prirodnih pokreta. Objavljen je prije više od godine dana, ali je jedina jasno pronađena objava o otvorenom video modelu na tom računu.

  12. Open Creative Studio v13.0, otvoreni integrirani ComfyUI radni tok — Alessandro Perilli, 2026-01-26, 0 lajkova
    https://bsky.app/profile/perilli.com/post/3mdddenkss22v
    Najavljuje besplatan, neograničen i visoko funkcionalan sve-u-jednom ComfyUI radni tok koji može generirati tekst, slike, video, zvuk, glazbu, zvučne efekte i stihove.

  13. Lokalno generiranje slika s Qwenom 3.7 27B, pelikan — Simon Willison, 2026-08-14, 183 lajka / 14 RP-a
    https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
    Izvještava da Qwen 3.7 27B, pokrenut putem LM Studioa na M5 Max MacBook Prou s 17 GB GGUF-om, generira najbolju sliku pelikana na biciklu koju je vidio među modelima koji rade na njegovu prijenosniku.

  14. Mreža usporedbe pelikana: GPT-6 Astra nasuprot GPT-5.6 modelima — Simon Willison, 2026-09-04, 202 lajka / 9 RP-a
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    Objavljuje mrežu od 12 slika koja uspoređuje GPT-6 Astru s modelima GPT-5.6 Sol, Terra i Luna, nastavljajući benchmark kulturu za zatvorene modele generiranja slika.

  15. GPT-6 Astra generira Blender 3D model, arhitektonska maketa — Ethan Mollick, 2026-09-05, 163 lajka / 17 RP-a
    https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
    Izvještava da je samo na temelju skice i opisa nastao Blenderov 3D model neizgrađenog memorijala iz 18. stoljeća, uz narirani walkthrough. U drugim objavama navodi da vizualno stvaranje postaje važan pokazatelj sposobnosti zatvorenih LLM-ova.

  16. „Midjourney je postao dio Meta.ai-ja” — Midjourney Experience Newsletter, 2026-02-03, 1 lajk
    https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
    ⚠️ Oprez: riječ je o objavi neslužbenog fan računa koja vjerojatno pretjerano pojednostavljuje činjenice. WebSearch potvrđuje da je Meta u kolovozu 2025. najavila licenciranje Midjourneyjeve „aesthetic tech”, a ne preuzimanje; Midjourney je ostao neovisan (TechCrunch, implicator.ai).

Signali
  • Zatvoreno generiranje videa u stanju je stalne utrke: Samo između prosinca 2025. i veljače 2026. feed luok.ai predstavio je barem sedam novih modela ili verzija: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 i Niji 7. Posebno se ističe zamah modela iz Kine: Klinga, Vidua, PixVersea i Seedancea.
  • Sora usporava i bliži se kraju: Objave dahara1 pokazuju da su krediti besplatne Sore već prestali raditi u travnju 2026., a krajem istog mjeseca izravno se govori o njezinu kraju. To je u skladu s izvještajima da je OpenAI ugasio aplikaciju i developerski API. Vodstvo u videu prelazi na kineske modele te na funkcije integrirane u opće Googleove i OpenAI-jeve modele.
  • Generiranje slika postaje benchmark značajka samog LLM-a: Objave Simona Willisona i Ethana Mollicka više ne tretiraju generator slika kao zaseban alat, nego uspoređuju vizualne i 3D sposobnosti općih LLM-ova kao što su GPT-6 Astra, Claude Fable 5.1 i Qwen 3.7/3.8 27B. Vizualno generiranje GPT-6 Astre, poput rekonstrukcije 3D arhitekture u Blenderu, postaje pokazatelj snage modela na društvenim mrežama.
  • Otvoreni video modeli na Blueskyju nisu mnogo prisutni: Kroz pretrage i istraživanje feedova pronađena je samo jedna jasna objava o otvorenom video modelu — SkyReels V1 iz veljače 2025. Nisu pronađena spominjanja Wana 2.2, Qwen-Imagea ili Z-Imagea, iako bi oni 2026. trebali biti aktualni. ComfyUI se redovito pojavljuje uglavnom kroz Perillijeve objave o Open Creative Studiou, više kao najava jednog projekta nego kao šira rasprava.
  • Odnos Midjourneyja i Mete lako se pogrešno tumači: Neslužbeni račun pojednostavljuje odnos kao da je Midjourney postao dio Meta.ai-ja, premda se radi o partnerstvu kroz licenciranje tehnologije, a ne o kupnji. To je dobar primjer potrebe za oprezom prema detaljima društvenih objava.
Ograničenja
  • Službeni Blueskyjev API za pretraživanje (app.bsky.feed.searchPosts) vraćao je 403 Forbidden na svaki upit, pa pretraživanje po ključnim riječima nije bilo moguće. Ostali javni API endpointi, kao što su app.bsky.actor.getProfile, app.bsky.feed.getAuthorFeed i app.bsky.feed.getPostThread, radili su normalno, što upućuje na ograničenje baš endpointa za pretragu.
  • Web pretraga na https://bsky.app/search?q=... također je klijentski renderirana, pa se sadržaj objava nije mogao dohvatiti.
  • Zbog toga su relevantni računi pronađeni putem web pretrage, a zatim su čitani njihovi feedovi. Taj pristup ovisi o računima koje je pronašla tražilica, a ne pruža potpunu pokrivenost po ključnim riječima; to može objasniti slabu pokrivenost otvorenog generiranja videa.
  • Web pretrage za Bluesky objave o „Wan2.2”, „Qwen-Image”, „Z-Image” i „HunyuanVideo” uglavnom su vraćale arXiv radove ili nepovezane račune, bez relevantnih objava.
  • Nije potvrđeno gdje se nalaze službeni Bluesky računi važnih tvrtki poput Black Forest Labsa, Runwaya, Stability AI-ja i Civitaija.
  • Feed stablediffusion.bsky.social stao je u siječnju i veljači 2025., pa nije upotrebljiv za praćenje novijih trendova.
  • Iako kriterij dovršenosti traži analizu približno 20 objava po društvenoj mreži, pregledano je više od 100 objava kroz feedove šest računa, od kojih je 16 tematski relevantnih odabrano za prikaz.

Lemmy

Lemmy — Najnoviji trendovi AI-ja za generiranje slika i videa

Lemmy je decentralizirani Fediverse s više instanci, pa je istraživanje prvenstveno koristilo API pretragu lemmy.world (/api/v3/search) i lemmy.today, koji prikazuje zajednice s lemmy.dbzer0.com, uz web pretrage poput site:lemmy.world. Pregledano je približno 25 objava.

Zajednice
  • !«メールアドレス» — Oko 5.050 pretplatnika; središnja zajednica otvorenog generiranja slika oko Stable Diffusiona.
  • !«メールアドレス» (lemmy.today prikazuje „Stable Diffusion Art”) — 2.362 pretplatnika. Svakodnevno objavljuje više radova izrađenih u SDXL-u, ComfyUI-ju i Krea2, često s poveznicama na civitai.com.
  • Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry i Stable Werewolves — zajednice specijalizirane po žanru unutar ekosustava lemmy.dbzer0.com. Brojevi pretplatnika nisu javni, ali objave su aktivne svakoga dana i u rujnu 2026.
  • c/«メールアドレス» — Opća tehnološka zajednica gdje se okupljaju velike vijesti o zatvorenim modelima, poput Midjourneyjeva skenera i Sore.
  • c/genart — Mala zajednica s 47 pretplatnika koja izrijekom podržava generativne AI modele otvorenog koda i otvorenih licenci.
  • c/«メールアドレス» — Zajednica posvećena negativnim osjećajima prema AI-ju. Nije isključivo vezana uz generiranje slika i videa, ali objava o pokušaju napuštanja oslanjanja na AI dosegla je 83 boda.
  • c/euroai — Nišna zajednica s popisima europskih otvorenih AI i LLM projekata, uključujući modele za generiranje slika.
Objave
Pretežno zatvoreni modeli
  1. „Midjourney pivots from AI image generation to body scanning medical spa” (2026-06-18, 58 bodova, technology) https://lemmy.world/post/... putem theregister.com — Tema o navodnom prelasku Midjourneyja s generiranja slika na ultrazvučni CT skener za medicinu. The Register navodi da je temeljna tehnologija stvarna, ali da partneri nisu imenovani.
  2. „Midjourney AI pivots to Theranos: Ultrasonic CT” (2026-06-19, 40 bodova, techtakes) putem pivot-to-ai.com — Sarkastična usporedba tog poteza s Theranosom.
  3. „I was wrong about the Midjourney ultrasound scanner” (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — Autor, koji je najprije bio skeptičan, nakon provjere činjenica povlači raniji stav.
  4. „Midjourney wants Hollywood studios to reveal details of their AI usage” (2026-07-05, 73 boda, technology) putem techcrunch.com — U sporu s trima studijima Midjourney traži otkrivanje detalja o stvarnoj upotrebi AI-ja u Hollywoodu.
  5. Reakcija na OpenAI-jevo gašenje Sore: „OpenAI: decides to shut down their AI slop video generating model Sorahttps://lemmy.world/post/44721138 — Ismijava kraj samostalne aplikacije Sora, najavljen 24. ožujka 2026., zaustavljen 26. travnja, uz planirano ukidanje Sora 2 API-ja 24. rujna 2026.
  6. „OpenAI collapses media reality with Sora AI video generator” https://lemmy.world/post/12056737 — Dijeljenje članka koji upozorava na gubitak povjerenja u anonimne videozapise.
  7. „OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports” https://lemmy.world/post/36665644 — Kritika pristupa prema kojem nositelji prava moraju sami zatražiti isključenje.
  8. „Elon Musk maakt complete AI-film met zijn versie van The Odyssey” (2026-07-22, films) putem ad.nl — Najava Muskovog dugometražnog AI filma „Odiseja” izrađenog s Grok Imagineom.
  9. Objava o analizi prihoda ChatGPT-a (2026-07-15, ai_reddit) — Analizira tvrdnju da velik dio prihoda Groka i xAI-ja dolazi od plaćenog NSFW sadržaja za generiranje slika i videa.
  10. „Video AI” — Pitanje o besplatnom limitu Adobe Fireflyja za generiranje videa. Firefly nudi samo dva besplatna pokušaja, a uspoređuju se Hailuo, Kling, Runway, Pixverse i Hunyuan.
Pretežno otvoreni modeli
  1. „Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio” (2026-07-24, 1 bod, tech) https://bfl.ai/blog/flux-3 — Ograničeno izdanje multimodalnog FLUX-a 3, sposobnog za generiranje slika i 20-sekundnih videa sa zvukom.
  2. „FLUX.2-klein-9b-kv-fp8 optimized variant” (2026-03-14, 8 bodova, stable_diffusion) putem huggingface.co — Lagana FLUX.2 izvedenica s podrškom za KV cache.
  3. „Black Forest Labs Opening up the first FLUX Creator Program” (2026-05-06, 3 boda, stable_diffusion) — Najava početka programa za autore.
  4. „Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf” (2026-06-03, films) putem nu.nl — Redatelj Martin Scorsese postaje savjetnik Black Forest Labsa.
  5. „FLUX Chroma (The Perchance T2i model)” (približno godinu dana staro, zajednica Perchance) putem huggingface.co(lodestones/Chroma) — Izvedeni model s NAG-om (Normalized Attentive Guidance), uz komentare koji hvale prikaz sinkronizacije usana.
  6. Primjeri svakodnevnih objava Stable Diffusion zajednica (2026-09-06 do 09, lokalno generiranje u SDXL-u, ComfyUI-ju i Krea2): „Erika - Mahouka Koukou No Rettousei” (16 bodova), „Colors in Quiet Water” (14), „Giant Wire Walker” (11) i „Karin - Umi Monogatari” (13), svi s poveznicama na civitai.com.
  7. „Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp” https://lemmy.world/post/3243205 — Predstavljanje otvorenog sučelja s nedestruktivnim slojevima poput GIMP-a.
  8. „Europäische KI- & LLM-Anbieter” (2026-02-15, euroai) — Popis europskih otvorenih AI projekata i LLM-ova koji naglašava tehnološku suverenost i zaštitu podataka, uključujući modele za generiranje slika.
  9. „Your Lemmy Crash Course to Free Open-Source AI” https://lemmy.world/post/76020 — Uvodni vodič kroz lokalne alate kao što su text-generation-webui, Automatic1111 i ComfyUI + Pinokio.
Signali
  • Najveća tema zatvorenih modela je kontroverza oko Midjourneyjeva ulaska u medicinu: Rasprava o zaokretu iz generiranja slika prema ultrazvučnoj dijagnostici, sa 40 do 73 boda, proteže se kroz technology, hackernews i techtakes zajednice. Ima i reakcija koje ga uspoređuju s prevarom poput Theranosa, ali i slučajeva gdje su prvotno skeptični korisnici naknadno ispravili stav nakon provjere činjenica.
  • OpenAI-jeva Sora stalno je meta kao primjer „AI smeća”. Čak i nakon gašenja aplikacije tijekom ožujka i travnja 2026., tema je živa zbog planiranog ukidanja Sora 2 API-ja 24. rujna 2026.
  • Na otvorenoj strani dominantan je Black Forest Labs i FLUX. FLUX 3, lagani FLUX.2-klein, Creator Program i Scorseseovo savjetničko mjesto daju konkretne novosti svaki kvartal.
  • Svakodnevne kreativne zajednice, poput Stable Diffusion Arta, Animea i Abstractiona, imaju relativno malo pretplatnika — od 2.000 do 5.000 — ali i dalje svakodnevno objavljuju lokalno generirane radove u SDXL-u, ComfyUI-ju i Krea2. To pokazuje dubinu stvarne primjene otvorenog koda.
  • Ni negativni osjećaji prema AI-ju nisu zanemarivi: Objavu zajednice c/fuck_ai o pokušaju oslobađanja od ovisnosti o AI-ju podržala su 83 boda, više od tipičnih AI objava. To pokazuje da na Lemmyju postoji stabilna odbojnost prema generiranom AI sadržaju.
  • Vijesti o zatvorenim modelima na Lemmyju uglavnom nisu originalno otkrivene na toj platformi, već su reakcije na članke TechCruncha, The Registera, WSJ-a i drugih vanjskih medija. Primarni izvori nalaze se izvan Lemmyja.
Ograničenja
  • Lemmy ima manji broj korisnika i objava od Reddita, pa su specijalizirane rasprave o AI-ju za generiranje slika i videa pliće. Nije pronađena zajednica koja detaljno obrađuje video modele poput Sore, Vea, Klinga ili Runwaya.
  • Pretraga cijelog teksta putem API-ja na lemmy.world nije bila precizna; opći upiti poput „AI image generation” vraćali su nepovezane objave, uključujući karte UN-a i razmnožavanje sova. Ciljani upiti po modelima, poput Sore, Midjourneyja i FLUX-a, bili su učinkovitiji.
  • Neke stranice, uključujući lemmy.world/post/44721138 i objavu povezanu s DLSS-om 5 na lemmy.world/post/44347792, vraćale su HTTP 500 ili nije bilo moguće dohvatiti sadržaj. Procjene se temelje samo na naslovima i WebSearch isječcima.
  • Izravna spominjanja Grok Imaginea, Qwen Imagea, HunyuanVideoa, Wana 2.2, Nano Banane, Geminija i Vea bila su rijetka ili nepostojeća. Grok Imagine pronađen je samo jednom, u kontekstu filmske produkcije, pa se može reći da ti modeli nisu bili značajna Lemmy tema.
  • Pojedinačne pretrage lemmy.ml i lemm.ee uglavnom su dale rezultate koji se preklapaju s lemmy.world rezultatima ili su bili zrcaljene objave iste federacije, bez novih informacija.

Pinterest

Pinterest — Vijesti o AI-ju za generiranje slika i videa

Svih 50 prikupljenih pinova otvoreno je kao slika i pregledano. Nisu razvrstani po žanru, nego su prikupljeni kao objedinjeni rezultati jednog upita „Image and Video Generation AI News”.

Vizualne teme (visual themes)
  • Preplavljenost predlošcima „robotsko lice + hitna vijest”: Stalno se pojavljuju thumbnailovi s polovicom lica bijelog humanoidnog robota i neonskim crvenim ili plavim tekstom poput „AI NEWS” i „BREAKING NEWS”. Primjeri uključuju robota za stolom voditelja vijesti [22], kompozit začuđenog muškog YouTubera i robotskog lica [29] te ženski robot s porukom „THE FUTURE IS AI” [39]. Dominiraju tamnoplava podloga i neonske cijan, magenta i narančasta.
  • Thumbnailovi s reakcijama YouTubera: Na više pinova ponavlja se fotografija začuđenog ili sumnjičavog bijelog muškarca uz kružne ikone s neonskim rubom za OpenAI, Google, Metu, Anthropic, Grok i Notion [4, 18]. Vjerojatno se radi o prijenosima iz YouTube videa.
  • Vertikalne infografike s popisima alata: Najčešći format su dugačke infografike tamne ljubičaste ili crne pozadine, s numeriranim karticama alata. Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI i Hailuo AI redovito se pojavljuju kao gotovo fiksni skup [9, 10, 27, 36, 50].
  • Formati prije/poslije i usporedni kvizovi: Vidljive su usporedbe dviju planinskih fotografija s pitanjem „Which is AI?” [13], kao i mreže koje isti izvorni video pretvaraju u likove od drvenih blokova, origamija, LEGO kockica ili cvijeća [11]. Takvi prikazi ističu koliko je AI sadržaj teško prepoznati i koliko uvjerljivo mijenja materijale.
  • Suradnja robota i ljudi te medicinske scene: Dio pinova prikazuje realistične CG scene bijelih humanoidnih robota koji s medicinskim osobljem koriste holograme [3, 33], kao i ilustracije liječnika sa stetoskopom uz robota [32]. Ton je mirniji i usmjeren na suživot AI-ja i ljudi.
  • Tamne boje i neon za tehnološki dojam: Gotovo 70 % materijala dijeli stil tamnoplave ili crne pozadine s cijan, magenta i ljubičastim neonskim vodovima i svjetlosnim česticama. To izgleda kao ustaljeni Pinterestov vizualni obrazac za tehnološke vijesti.
  • Reklame za AI video s avatarima i osobnostima: Pojavljuju se oglasi za stvaranje objašnjavajućih AI videa, nalik Fiverru, s manipuliranom slikom Jeffa Bezosa [38], kao i AMD-ov fotorealistični demo Amusea 3.0 s licem starog ribara [46]. Lica poznatih osoba i fotorealistični portreti koriste se kao dokaz kvalitete generiranja.
  • Slike o tome hoće li se AI sadržaj prepoznati: Više pinova, poput robota koji gleda mobitel uz oznaku „FAKE” i usporedbe fotografije mačke sa siluetom maskirane osobe [3], te predstavljanja alata za otkrivanje AI-ja [37], vizualizira brigu oko autentičnosti i dezinformacija.
Značajni pinovi (notable pins)
  • [11] Demonstracija transformacije materijala nalik Luma AI-ju: Pet varijanti istog izvornog videa, s osobom, plišanom pandom i automobilom, pretvara se u drvene blokove, origami, LEGO kocke i cvijeće. To je najkonkretniji pin koji prikazuje sposobnost AI-ja za promjenu teksture u videu.
  • [24] ByteDance i Hollywood postižu sporazum o AI autorskim pravima: Screenshot članka s naslovom „ByteDance and Hollywood reach global deal on AI copyright”. Navodi da je ByteDance postigao globalni sporazum s Motion Picture Associationom (MPA) radi jačanja zaštite intelektualnog vlasništva u AI alatima za slike i video. Riječ je o sadržaju bliskom primarnom izvoru za promjene u pristupu autorskim pravima velikih zatvorenih igrača.
  • [35] Pregled AI vijesti od 12. kolovoza 2026.: Tri vijesti — „Grok 4.6 drops”, koji autonomno radi desetke koraka i provjerava vlastiti rad; „Gemini hits 1 billion users”, s navodom da je Google dosegao 100 milijuna korisnika najbrže u povijesti, da dvije od tri osobe koriste glasovni unos i da se dnevno generira 150 milijuna slika; te „Honor's robot phone”, telefon s titanijskom rukom koja automatski prati objekt kamerom. To je rijedak pin s jasno označenim datumima i brojkama.
  • [36] Rang-ljestvica „Best AI Video Generators of 2026”: Google Veo 3.1, Runway Gen 4.5 i Kling 3.0 nalaze se na vrhu s ikonama krune, a slijede Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 i HeyGen. To je popis s najnovijim generacijama modela i verzijama.
  • [42] Vidu S1 tvrtke ShengShu Technology: Proizvodna vizualizacija kineskog modela za video koji se predstavlja kao „The World's Most Advanced Model for Real-Time AI Interaction”. Jedan je od rijetkih primjera koji pokazuje aktere izvan dominantnih zapadnih modela.
  • [45] Članak koji najavljuje OpenAI-jev novi alat za slike: Slika članka s naslovom „OpenAI's Secret Image Generation Tool to Debut Soon”, koji potiče očekivanja oko nenajavljenog proizvoda.
  • [25] Pregled Google I/O-a 2026.: Sažetak od 20. svibnja 2026. o najavama Gemini 3.5 Flasha, Gemini Omnija i Gemini Sparka, prelasku na AI pretraživanje te konkurenciji Appleovih i Googleovih XR naočala. Ne govori samo o generiranju slika, ali daje kontekst šireg ekosustava.
  • [9] Infografika za usporedbu video alata „Just Nail It”: Organizira Runway, Pika, Kling AI, Luma AI, Canva AI i Hailuo AI prema funkcijama i ciljanim korisnicima, uz tvrdnju da će do 2026. 80 % online sadržaja uključivati video.
  • [8] Skup ikona za AI generiranje sadržaja u stock fotografiji: Adobe Stock stil slike „Ai Content Creation Concept” s ikonama za generiranje teksta, slika, glazbe i videa. Više ukazuje na potražnju za takvim vizualima nego na stvarne vijesti.
  • [43] Infografika povijesti generativnog AI-ja: Ljubičasta vremenska crta od ELIZE iz 1950-ih do GPT-a 2020-ih, koja aktualni val generativnog AI-ja smješta u povijesni kontekst.
Signali (signals)
  • Sukob otvorenog i zatvorenog pristupa teško je iščitati samo iz slika: Pinterest pinovi uglavnom su predstavljanja alata, novinski thumbnailovi i vodiči, a ne izravne usporedbe otvorenog i zatvorenog pristupa kao što su Seedance protiv Wana na Redditu ili X-u. Vidu S1 [42] iz Kine i Amuse 3.0 [46], koji je povezan s AMD-om i lokalnim generiranjem, donekle se ističu kao alternative velikim zatvorenim američkim alatima poput Google Vea, OpenAI Sore i Runwaya.
  • Dominiraju sažeci, usporedbe i vodiči, dok je brzih vijesti malo: Od 50 pinova samo nekolicina, poput [24], [25], [35] i [45], daje datume ili konkretne objave. Većina su trajni listicle sadržaji poput „Best AI Video Generators” i „10 Smart Ways”, prilagođeni Pinterestu i često povezani s affiliate promocijom.
  • Vidljiv je interes za nepovjerenje i provjeru autentičnosti: Više slika, poput [3], [22] i [37], uključuje oznake „FAKE”, robotske novinare ili alate za detekciju AI-ja. To ukazuje da među Pinterest korisnicima postoji interes za sumnju prema generiranom sadržaju i za provjeru njegova podrijetla.
  • Generacije modela mijenjaju se brzo: Pin [36] navodi Veo 3.1, Runway Gen 4.5, Kling 3.0 i Seedance 1.5 Pro kao aktualne verzije 2026., dok [35] spominje Grok 4.6 i Gemini s milijardom korisnika. To dodatno pokazuje da su ažuriranja po kvartalima postala uobičajena.
  • Nedostatak otvorene lokalne kulture: Niti jedna od 50 slika ne predstavlja Stable Diffusion, ComfyUI ili Hugging Face, koji na Redditu simboliziraju lokalne i samostalno hostane otvorene modele. Pinterestovi rezultati snažno su nagnuti komercijalnim alatima i SaaS promotivnim materijalima, a izvorna komunikacija otvorenih zajednica gotovo se ne vidi.
Ograničenja
  • Prikupljanje je prethodno obavio radnik pomoću preglednika bez sučelja; agent nije izravno pregledavao Pinterest, u skladu s playbookom.
  • Nije bilo razvrstavanja po žanru kroz sekcije ## <genre> (n); svih 50 rezultata dolazi iz jednog pretraživačkog upita, pa usporedba između žanrova nije moguća.
  • Pet pinova, [5, 13, 15, 20, 24], ima naslov „(untitled)”. Za pin [24] naslov je prazan, ali sadržaj se može procijeniti iz slike članka.
  • URL-ovi pinova, pinterest.com/pin/..., navedeni su, ali odredišne poveznice nisu izravno otvorene i provjerene; zaključci se temelje samo na slikama i naslovima. Pinterestovi podaci o datumima objave i lajkovima nisu bili prikupljeni, pa se vrijeme objave ne može odrediti osim kada je datum utisnut na samoj slici, kao kod [25] i [35].
  • U odnosu na kriterij dovršenosti koji traži najmanje deset uvida za zatvorene i deset za otvorene modele, Pinterest sam pruža malo konkretnih otvorenih nalaza. Tek Vidu [42] i AMD-povezani Amuse [46] donekle odskaču; taj nedostatak treba nadopuniti rezultatima drugih platformi, osobito Reddita.

Preporučene akcije

  • Na X-u zamijeniti upite pojmovima izravno vezanima uz temu, kao što su Midjourney, Stable Diffusion, Sora, Nano Banana i Qwen-Image, pa ponovno prikupiti sadržaj.
  • U sljedeće Reddit istraživanje uključiti ključne velike zajednice r/StableDiffusion, r/midjourney i r/comfyui.
  • Zbog nedostupnog Blueskyjeva API-ja za pretragu, glavne ovdje pronađene račune pretvoriti u popis za kontinuirano praćenje.
  • U sljedećem istraživanju najviše pratiti ukidanje OpenAI-jeva Sora API-ja 24. rujna 2026. i daljnje vijesti o Midjourneyjevu poslovnom zaokretu.

Prikupljene slike

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAI News: Anthropic Leak Shows Us The Future of AI...imageThe Ultimate AI Image and Video Generation Platform - The Data ScientistGoogle Unveils Veo 2: Advanced AI Video Generation...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoJust Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!Google announces ultra-high quality video...AI For Image And video GenerationimageAI Video Content Creation: High earners,...imageAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI News: OpenAI Finally Released What We Asked For️ Image to Video AI – Animate Your Photos With AIimageDiscover how Grok is revolutionizing video...‎🚨 AI is getting scary good.Top AI Video Generators of 2025imageimageMore than 20% of YouTube is now AI-generated5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreArtificial intelligence: let’s maintain our...AI Video Creation: 10 Smart Ways to Create Engaging Videos FasterWhat is Imagvio AI and how it helps creators...AI driven image and video analysisThe potential impact of artificial intelligence on...AiAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026Breaking News Latest AI Developments - Grok 4.6 Gemini 1B Honor Robot PhoneFuture of Video Creation: Best AI Video Generators of 2026🔸How To Detect AI-Generated Images Online For FreeI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingAI Video Creation: Complete Guide to Create Professional Videos Faster with AIHow AI Is Transforming Video EditingShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI Videohistory generative AIMastering Video and AI: Key Social Media Marketing Trends 2025OpenAI’s Secret Image Generation Tool to Debut Soon'Amuse 3.0', an AI art creation tool that includes...The most impressive creations from Internet users...Transform your ideas into stunning visuals! 🎥Viral Tiny People AI Effect—Learn How to Create It!12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & More

Napomena o kvaliteti podataka

X zbog nepodudarnosti pretraživačkih pojmova nije prikupio nijednu objavu povezanu s temom. Bluesky, Pinterest i YouTube nisu u potpunosti omogućili pretragu ili metrike angažmana, pa su neki dijelovi brojčano slabije potkrijepljeni.

Galerija