KEN’S CAT LOG

Vijesti o AI-ju za generiranje slika i videa — 2026-09-04

Zatvoreni sustavi kreću se prema objedinjavanju generiranja, uređivanja i zvuka u jednom modelu (FLUX 3, Kling 3.0), dok laboratoriji iz Kine (Alibaba, Tencent) u svijetu otvorenog koda iz mjeseca u mjesec objavljuju modele s licencom Apache 2.0 i malim zahtjevima za VRAM. Granica između dva tabora pritom se zamagljuje hibridnim licencama poput onih za FLUX 3 i MiniMax H3.

Vijesti o AI-ju za generiranje slika i videa — 2026-09-04

Zatvoreni modeli prelaze iz faze „natjecanja u kvaliteti pojedinačne slike” u fazu objedinjavanja generiranja, uređivanja i zvuka u jednom modelu (a FLUX 3 ide i do predviđanja radnji). Google Nano Banana Pro gotovo dominira generiranjem slika, dok je OpenAI, primjerice, u ožujku 2026. ugasio aplikaciju Sora, što pokazuje podijeljenu sliku tržišta. U svijetu otvorenog koda laboratoriji iz Kine, predvođeni Alibabom (Wan/Qwen-Image/Z-Image) i Tencentom (Hunyuan), gotovo svaki mjesec objavljuju Apache 2.0 modele te se probijaju u ComfyUI zajednicu porukom da rade na potrošačkim GPU-ovima. Granice između dva tabora postaju nejasne: primjetni su hibridni modeli poput „otvorenih težina, ali zapravo ograničenog ranog pristupa” (FLUX 3) ili „težine su otvorene, ali jedna tvrtka ima ekskluzivnu prodaju komercijalne licence” (MiniMax H3). Od šest istraženih platformi Reddit je bio potpuno nedostupan, Bluesky nije vratio nijednu objavu o aktualnim modelima iz 2026., a Pinterest gotovo da nije pružio uvide o otvorenom kodu. Ovo se izvješće stoga u praksi oslanja na X, YouTube i Lemmy.

Uvidi kroz platforme

  • X i YouTube slažu se da FLUX 3 „nije otvoren”. Novi model Black Forest Labsa objedinjuje sliku, video, zvuk i predviđanje radnji, ali i objava @bfl_ai i napomena korisnika @kimmonismus jasno navode da je riječ o „gated early access, not open source”. YouTube video tvrtke ElevenLabs (https://www.youtube.com/watch?v=WlGmDRLZt9o) posebno naglašava istu činjenicu.
  • X, YouTube i Lemmy podudaraju se u tome da su laboratoriji iz Kine glavno bojište otvorenog koda. Alibaba (Wan2.2/2.6/2.7, Qwen-Image, Z-Image-Turbo) i Tencent (HunyuanVideo 1.5, HunyuanImage 3.0) gotovo mjesečno objavljuju nove modele, a njihovi ComfyUI čvorovi gotovo su svakodnevna tema zajednice !«メールアドレス» na Lemmyju.
  • Rad na potrošačkom GPU-u zajednička je prodajna poruka otvorenih modela. Z-Image-Turbo (16 GB VRAM-a, @stevenhoi) i HunyuanVideo 1.5 (14 GB, TensorArt video https://www.youtube.com/watch?v=MJShdc8tkkA) na X-u i YouTubeu predstavljeni su uz iste brojke.
  • Povlačenje aplikacije Sora potvrđeno je iz različitih kutova na YouTubeu i Lemmyju. YouTube (NBC News https://www.youtube.com/watch?v=6e3SINmPii4, Wall Street Millennial https://www.youtube.com/watch?v=ZkRYH6PEP5k) izvještava o zabrinutosti zbog deepfakeova i financijskim gubicima, dok Lemmy (preneseno preko https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/, 2026-05-27) navodi konkretan propali AI filmski projekt vrijedan 30 milijuna dolara.
  • Poredak na arenama (Artificial Analysis / Arena.ai) postao je zajedničko mjerilo u objavama, što potvrđuju i X i Lemmy. Najave novih modela, zatvorenih i otvorenih, redovito uključuju plasman na arenama, a @ArtificialAnlys na X-u služi kao provjeravatelj tih tvrdnji.
  • Zamagljivanje granice otvoreno/zatvoreno ima zasebne primjere na X-u (FLUX 3) i Lemmyju (MiniMax H3). Težine MiniMax H3 modela su otvorene (MiniMax Community License), ali Comfy ekskluzivno prodaje komercijalne licence (https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller), što ruši jednostavnu podjelu na dvije kategorije.
  • Ograničenja pristupa samim platformama bila su najveća zajednička prepreka istraživanju. Izravan pristup Redditu, Blueskyjevu API-ju za pretragu i YouTube stranicama bio je blokiran pa se svaka faza morala oslanjati na neizravne informacije preko WebSearcha.

Po platformama

Reddit — Nije bilo mogućeg pristupa ni reddit.comu, ni zrcalima, ni archive.orgu, pa je istraživanje završilo s nula objava. Popratni članci neizravno su spominjali „velik interes za Wan 2.5 na r/StableDiffusionu” i „potragu za zamjenama nakon gašenja Sore na r/SoraAi”, ali to nije prihvaćeno kao činjenica jer primarni izvori nisu otvoreni.

X — Provjerena je 21 objava; to je platforma s najviše informacija u ovom izvješću. Kombinacijom primarnih najava službenih računa (xAI, Runway, Alibaba_Wan, Alibaba_Qwen, TencentHunyuan, bfl_ai, Kling_ai) i provjera industrijskih promatrača poput Artificial Analysisa i rohan_paula, izvedeno je 12 uvida o zatvorenim i 9 o otvorenim modelima. Bez prijave uglavnom nisu bili dostupni pokazatelji angažmana poput broja lajkova i repostova.

YouTube — Pretraga preko WebSearcha radila je stabilno; potvrđeno je 11 zatvorenih i 11 otvorenih tema, ukupno 22 naslova videa, kanala i opisa sadržaja. No pristup samim stranicama videa bio je ograničen, pa nisu potvrđeni pregledi, broj pretplatnika ni komentari.

Bluesky — Pronađeno je samo 10 objava (4 o zatvorenim i 6 o otvorenim modelima). Većina pripada hobističkoj zajednici Civitai/Stable Diffusion iz 2024. i prve polovice 2025.; nijedan glavni model iz 2026. (Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3 i drugi) nije pronađen. Nisu potvrđeni ni službeni računi laboratorija, pa se Bluesky doimao kao svijet odvojen od ciklusa vijesti na X-u. Glavni je razlog vjerojatno blokada API-ja za pretragu s odgovorom 403.

Lemmy — Potvrđeno je 13 objava. !«メールアドレス» (oko 5.600 članova) djeluje kao glavno mjesto za otvoreni kod i obiluje praktičnim ComfyUI temama poput MiniMax H3, LTX-2.3/2.5 i Boogu-Image-0.1. Kod zatvorenih modela više bodova dobivaju teme o kontroverzama i tužbama — povlačenje Sore, tužba povezana s Grok CSAM-om i kritike DLSS-a 5 — nego same najave novih modela.

Pinterest — Od 50 prikupljenih Pinova, 32 su pregledana kao slike. Većinu čine infografike za usporedbu „najboljih alata” s velikim zatvorenim brendovima (Google Veo, Sora, Runway, Kling, Midjourney i sl.). Pinovi koji se bave otvorenim kodom (Stable Diffusion, Flux, Wan, HunyuanVideo) praktično ne postoje. U više slučajeva naslov Pina nije odgovarao sadržaju slike, pa je potvrđeno da Pinterest za aktualne vijesti zaostaje za drugim platformama.

Što pratiti dalje

Preporučene aktivnosti

  • Kontinuirano pratiti X i YouTube kao primarne izvore informacija o zatvorenim modelima.
  • Za trendove implementacije otvorenih modela koristiti !«メールアドレス» kao stalnu točku praćenja ComfyUI ekosustava.
  • Za Reddit i Bluesky pripremiti prijavljene sesije ili službene API ključeve prije sljedećeg istraživanja; bez drukčijeg pristupa istraživanje neće biti učinkovito.
  • Pinterest nije pogodan za aktualne vijesti; sljedeći put ga koristiti samo za analizu vizualnih trendova, poput stilova naslovnica i paleta boja.
  • Primjere koji se predstavljaju kao otvorene težine, ali zapravo koriste ograničeni pristup ili hibridne licence (FLUX 3, MiniMax H3), klasificirati tek nakon provjere teksta licence.
  • Redovito provjeravati Lemmy zbog pravnih i kontroverznih vijesti poput povlačenja Sore i Grokovih tužbi, jer ondje često prije X-a izlaze konkretni primjeri s iznosima i sudskim dokumentima.

Kvaliteta podataka

Reddit je zbog tehničke blokade pristupa imao nula objava, pa ovo istraživanje nije dalo nikakve uvide o toj temi na toj platformi. Blueskyjev API za pretragu bio je blokiran odgovorom 403, što je prisililo oslanjanje na indeks preko WebSearcha; većina pronađenih objava bila je stara, iz 2024. i prve polovice 2025., te nije spominjala ključne modele iz 2026. Pinterest gotovo da nije pružio konkretne uvide o otvorenom kodu (osim AMD Amuse 3.0) i bio je pristran prema općim infografikama o zatvorenim modelima. X, YouTube i Lemmy zajedno su dali više od 20 potvrđenih objava, videa ili rasprava svaki te čine glavni dokazni temelj ovog izvješća.

Sažetak po platformama

Reddit

Reddit — vijesti o AI-ju za generiranje slika i videa (zatvoreni izvor / otvoreni izvor)

Gdje

U ovoj fazi nije bilo nikakvog pristupa reddit.comu, pa nije bilo moguće potvrditi koji su subredditi zaista aktivni na ovoj temi, uključujući broj pretplatnika. Postoje subredditi koji se obično spominju na ovom području (r/StableDiffusion, r/midjourney, r/aivideo, r/SoraAi, r/singularity i drugi), ali ih ovaj put nije bilo moguće otvoriti te ih se ne može prijaviti kao „potvrđena mjesta”.

Što ljudi govore

U ovom okruženju alata nije bilo moguće otvoriti nijednu Reddit objavu. Stoga nema konkretnih nalaza s poveznicom na objavu, brojem upvoteova i datumom. Nije bilo moguće provesti ni analizu 5–12 objava koju zahtijeva playbook ni približno 20 objava koje zahtijeva brief.

Sljedeće su samo tvrdnje do kojih se došlo preko WebSearcha, gdje su druge stranice (blogovi i sažetci) neizravno navodile „što se govori na Redditu”. Budući da nisu izravno otvorene i provjerene, ne uzimaju se kao činjenice, već ostaju samo referentne bilješke:

  • Jedan sažetak navodi da je nit o Wanu 2.5 na r/StableDiffusionu dobila stotine upvoteova i komentara, da je nativno generiranje zvuka bilo dobro prihvaćeno te da je bilo mnogo zahtjeva za objavu otvorenih težina. URL niti i stvarni broj upvoteova nisu potvrđeni.
  • Drugi članak navodi da je nakon što je OpenAI 26. travnja 2026. ugasio aplikaciju Sora, na r/SoraAi naglo porastao broj objava s pitanjem „Koja je alternativa?”. Primarni izvor ni u ovom slučaju nije otvoren.
  • Postojala je i tvrdnja da je ByteDance Seedance 2.0 postao viralna objava s više od 12.300 upvoteova na r/aivideo, ali ni poveznica ni datum nisu potvrđeni.

To nisu rezultati stvarnog čitanja Reddita i ne bi se smjeli koristiti u glavnom dijelu izvješća kao najmanje deset uvida za zatvorene i otvorene modele.

Signali

Sa samog Reddita nisu prikupljeni signali. Jedino se može reći da teme koje su spominjali popratni članci — nativno generiranje zvuka Wana 2.5, reakcije na gašenje Sore i interes za Seedance 2.0 — na razini prepričavanja sugeriraju da su navodno bile teme na Redditu. Trebalo bi ih izravno provjeriti na drugim platformama, poput X-a i YouTubea; ne mogu se računati kao rezultat ove faze.

Ograničenja
  • Svi pokušaji izravnog pristupa reddit.comu nisu uspjeli. Pokušani su www.reddit.com (uključujući početnu stranicu) i old.reddit.com preko WebFetcha, no oba su odbijena blokadom „Claude Code is unable to fetch from ...”.
  • Pokušani su i zrcalni/proxy servisi, bez uspjeha: redlib.catsarch.com → HTTP 403, libreddit.spike.codes → neuspješno DNS razrješenje, teddit.net → također blokiran.
  • Pokušaj dohvaćanja povijesnih snimki Reddita preko web.archive.org također nije uspio jer je pristup archive.orgu bio blokiran.
  • WebSearch je korišten više od deset puta, s upitima site:reddit.com, imenima subreddita i konkretnim naslovima niti (primjerice „site:reddit.com r/StableDiffusion new open source model”, „Wan 2.5 open source video model reddit thread discussion release” i slično), ali nijednom nije vraćen stvarni URL s reddit.coma. Rezultati su uvijek bili zamijenjeni sekundarnim izvorima poput Wikipedije, korporativnih blogova, Substacka i Hugging Facea.
  • Posljedično, nisu bili ispunjeni ni zahtjevi playbooka za stvarne poveznice s brojem upvoteova i datumom ni kriterij završetka briefa od približno 20 analiziranih objava.
  • Zaključak: u ovoj je fazi Reddit kao platforma praktično bio zatvoren (nije imao što ponuditi). Preporučuje se prikupljanje zamjenskih društvenih signala s drugih platformi: X-a, YouTubea, Blueskyja, Lemmyja i Pinteresta.

X

X — vijesti o generiranju slika i videa pomoću AI-ja

X (nekadašnji Twitter) nije moguće čitati bez prijave, stoga se tekst i URL-ovi pojedinačnih objava prikupljaju preko vanjske pretrage site:x.com. Gotovo sve objave dolaze od službenih računa (xAI, Runway, Alibaba_Qwen, Alibaba_Wan, TencentHunyuan, bfl_ai, Kling_ai, ideogram_ai i drugi) ili industrijskih promatrača/agregatora poput Artificial Analysisa, Rohana Paula i LudovicCreatora.

Računi i hashtagovi

Izvori za zatvorene modele

  • @xai — najave poput ukidanja Grok Imagine / grok-2-image-1212
  • @runwayml — primarni izvor za Gen-4 i Gen-4.5
  • @Kling_ai — najava Klinga 3.0
  • @bfl_ai (Black Forest Labs) — FLUX 3 (trenutačno bliži zatvorenom modelu zbog ograničenog ranog pristupa)
  • @ideogram_ai — najave širenja kroz partnerstva
  • @ArtificialAnlys (Artificial Analysis) — kontinuirano objavljuje poretke modela na arenama i prati i zatvorene i otvorene modele

Izvori za otvoreni kod

  • @Alibaba_Wan / @AlibabaGroup — primarne informacije o seriji Wan2.1/2.2/2.6
  • @Alibaba_Qwen — Qwen-Image / Qwen-Image-2512
  • @Ali_TongyiLab — Z-Image / Z-Image-Turbo
  • @TencentHunyuan — HunyuanImage 2.1/3.0, HunyuanVideo 1.5, Hunyuan-GameCraft
  • @stevenhoi (Tongyi-MAI) — osobna najava objave Z-Image-Turba
  • @rohanpaul_ai — često objavljuje rasprave s objašnjenjima otvorenih modela iz Kine
  • Hashtagovi / pojmovi za pretragu: #OpenSource, #Wan22, #QwenImage, česta spominjanja licence Apache 2.0
Objave
Zatvoreni modeli
  1. Poredak GPT Image 2 / MAI-Image-2.6 na arenama@ChanPerco: izvještava da je GPT-Image 2 prvi, a Microsoftov MAI-Image-2.6 drugi, ispred Grok Imaginea 2.0. (Datum nije poznat; objava je iz druge polovice 2026. Broj angažmana nije javno vidljiv iz teksta.)
  2. MAI-Image-2.6 zauzima treće mjesto na areni@testingcatalog: „MAI-Image-2.6 scored in the 3rd spot on Image Arena and is now available on MAI Playground and Microsoft Foundry in private preview.”
  3. Tajanstveni model „duct-tape”@arrakis_ai: anonimni testni model, za koji se pretpostavlja da je temeljen na GPT-u, privukao je pozornost na areni. „Holy shxt… The rules of AI image generation just completely changed.” Istaknuto je veliko poboljšanje nativnog ispisivanja teksta.
  4. Smjena generacije Grokova slikovnog modela@daisuke: objava o ukidanju modela „grok-2-image-1212 model effective Feb 28, 2026” i prelasku na grok-imagine-image (citat službene xAI najave).
  5. xAI Imagine v0.9 video model@xai: „Introducing Imagine v0.9, our new video generation model with massive upgrades from v0.1 in visual quality, motion, audio generation”, besplatno dostupan u svim proizvodima.
  6. Runway Gen-4.5@runwayml: predstavljen kao novi temeljni model s rezultatom od 1.247 Elo bodova na Text to Video areni. Tvrtka je potom objavila i Gen-4.5 Image to Video: „Built for longer stories. Precise camera control. Coherent narratives.”
  7. Najava Klinga 3.0@Kling_ai: uz slogan „Everyone a Director” predstavljen je all-in-one model koji objedinjuje generiranje, uređivanje i zvuk, uz generiranje isječaka od 15 sekundi. Francuski kreator @tardquin također je odmah prenio vijest.
  8. O ekonomiji Klinga 3.0@CNBizInsider: analizira se da bi model „could fundamentally reshape video AI economics”.
  9. Primjeri korištenja Nano Banana Proa (Google)@101babich: niz praktičnih primjera s tri načina uporabe u produktnom dizajnu.
  10. Usporedba Nano Banana i Nano Banana Proa@immasiddx: usporedba kvalitete starog i novog modela uz reakciju „We're cooked 💀”; spomenute su i anatomske pogreške poput prikaza prstiju.
  11. FLUX 3 stigao kao zatvoreni model@kimmonismus: Black Forest Labs predstavio je „FLUX 3”, koji objedinjuje sliku, video, zvuk i predviđanje radnji, no izričito navodi: „The current release is gated early access, not open source.”
  12. Službena najava FLUX 3 Videa@bfl_ai (primarni izvor): „One multi-modal model for Image, Video, Audio and Action-Prediction”, s podrškom za video od 20 sekundi i višejezične dijaloge. U kasnijoj objavi „FLUX 3 Video is #2 in the world” ističe plasman na areni i ograničeno razdoblje besplatne dostupnosti.
Otvoreni modeli
  1. Službeno izdanje Wana2.2@Alibaba_Wan (službeno): „The World's First Open-Source MoE-Architecture Video Generation Model with Cinematic Control!”. Osobni račun @scaling01 odmah je proširio vijest.
  2. Wan2.6: video i zvuk u jednom prolazu@FutureStacked: „the first open-source model that generates video AND audio together in a single pass. No stitching. No external tools.”
  3. Objavljen Wan2.2-Animate@Alibaba_Wan: objedinjeni model za animaciju i zamjenu likova. „model weights and inference code are now open-source for the entire community!”
  4. Objavljen Qwen-Image@Alibaba_Qwen (službeno): MMDiT model s 20 milijardi parametara, promoviran uz „SOTA text rendering — rivals GPT-4o in English”. @rohanpaul_ai dodaje da radi pod licencom Apache 2.0, pa ga svatko može besplatno implementirati.
  5. Qwen-Image-2512 (novogodišnje ažuriranje)@Alibaba_Qwen: objavljeni su vlastiti rezultati benchmarka uz tvrdnju: „Tested in 10,000+ blind rounds on AI Arena, Qwen-Image-2512 ranks as the strongest open-source”.
  6. Qwen-Image-Layered@azed_ai: iznenađenje zbog značajke uređivanja razlaganjem slika na izvorno izmjenjive dijelove: „natively breaks images into editable parts, not masks, not hacks 🤯”.
  7. HunyuanVideo 1.5@TencentHunyuan (službeno): samoproglašeni „the strongest open-source video generation model”, s 8,3 milijarde parametara i mogućnošću rada na potrošačkom GPU-u s 14 GB VRAM-a.
  8. HunyuanImage 3.0@TencentHunyuan: „the largest and most powerful open-source text-to-image model to date, with over 80 billion total parameters”.
  9. Objavljen Z-Image-Turbo@stevenhoi (član Tongyi-MAI tima): predstavljen je model od 6B parametara s „sub-second inference speed on consumer gpu w/ 16GB VRAM”. Sljedećeg tjedna Artificial Analysis proglasio ga je prvim u kategoriji slikovnih modela s otvorenim težinama, a Arena.ai potvrdio je plasman pod licencom „Apache 2.0”.
Signali
  • Glavno područje otvorenih modela koncentrirano je u kineskim laboratorijima: Alibaba (Wan / Qwen-Image / Z-Image) i Tencent (Hunyuan) objavljuju modele svakih nekoliko tjedana. Na X-u se ustalio ciklus „najava → neovisna provjera → ponovno rangiranje na areni”, gdje objave odmah provjeravaju Artificial Analysis i pojedinci iz zajednice.
  • Zatvoreni sustavi prelaze iz „natjecanja u kvaliteti pojedinačne slike” prema integraciji i ekosustavima: Kling 3.0 i FLUX 3 oba spajaju generiranje, uređivanje i zvuk, a FLUX 3 dodaje predviđanje radnji i robotiku. U rezultatima pretrage pojavila se i ocjena da „the AI generator era is already ending, with competitors racing to own the whole process”.
  • Granica otvoreno/zatvoreno postaje nejasna: FLUX 3 Black Forest Labsa reklamiran je kao model s otvorenim težinama, ali je zapravo krenuo kao ograničeni rani pristup uz kasnije obećanje otvorenih težina. Ne treba se oslanjati samo na marketinške riječi „open source”; licencu treba svaki put provjeriti, posebno razlikuje li se Apache 2.0.
  • Glavno bojište benchmarka je arena Artificial Analysisa: bez obzira na to jesu li modeli zatvoreni ili otvoreni, najave redovito uključuju brojčani plasman na areni, što korisnicima X-a služi kao zajedničko mjerilo.
  • Niski zahtjevi za VRAM postali su prodajna poruka: otvoreni modeli poput Z-Image-Turba (16 GB) i HunyuanVidea 1.5 (14 GB) stalno naglašavaju rad na potrošačkim GPU-ovima. To je očito strateški usmjereno na zajednicu lokalnog pokretanja, osobito oko ComfyUI-ja.
Ograničenja
  • Bez prijave na X, sve su objave prikupljene preko Googleovih rezultata za site:x.com i njihovih sažetaka. Konkretni brojevi lajkova i repostova uglavnom nisu bili dostupni jer ih isječci rezultata pretrage ne sadrže.
  • Točan datum objave nije moguće izvesti iz statusnog ID-a, pa se za mnoge objave može utvrditi samo da su objavljene tijekom 2026. Strogi kronološki redoslijed stoga nije zajamčen.
  • Nisu pronađene upotrebljive nitter instance ni Threadreader, pa izravna provjera nije bila moguća.
  • Za Midjourney (v7/video značajke), Adobe Firefly, Ideogram i zapadne zatvorene pružatelje osim Runwaya (Luma, Pika, Stability AI) primarnih objava na X-u bilo je malo; dostupni su uglavnom sekundarni izvori.
  • Kriterij od približno 20 objava ispunjen je s 21 stavkom u odjeljku Objave (12 zatvorenih, 9 otvorenih). Ipak, dio naknadnih objava o istoj temi, primjerice više objava računa bfl_ai, grupiran je kao jedna stavka; stvarno je referencirano više od 25 objava.

YouTube

YouTube — vijesti o AI-ju za generiranje slika i videa (zatvoreni izvor / otvoreni izvor)

Službena YouTube stranica rezultata pretrage (youtube.com/results) zahtjevna je za JavaScript prikaz, a WebFetch je uspijevao dohvatiti samo podnožje stranice. Zato su URL-ovi pojedinih videa prikupljani pretragom site:youtube.com <ključna riječ> preko WebSearcha, a naslov i naziv kanala primarno su provjereni preko službenog YouTube API-ja youtube.com/oembed?url=.... Datum i sadržaj dodatno su potkrijepljeni isječcima WebSearcha i izvornim člancima. Broj pregleda i broj pretplatnika nisu mogli biti potvrđeni (detalji su u Ograničenjima).

Kanali

Kanali koji izvještavaju o zatvorenim modelima

  • Paul J Lipsky — recenzija Klinga 3.0
  • Theo - t3gg(t3.gg) — analiza Nano Banana Proa
  • NBC News — izvještaji o Nano Banana Prou i Sori
  • TheAIGRID — brze vijesti o Sori 2
  • OpenArt — praktični prikazi Sore 2 / Wana 2.7
  • Wall Street Millennial — financijska analiza povlačenja Sore
  • ElevenLabs — objašnjenje FLUX-a 3
  • ApiTechTips — predstavljanje Seedancea 2.5
  • LLM Master — vodič za Grok Imagine 0.9
  • Standarity — objašnjenje Seedreama 5.0 Pro

Kanali koji izvještavaju o otvorenim modelima

  • Codedigipt — Wan 2.6 / Z-Image Turbo
  • Sebastian Kamph — Wan 2.6 R2V
  • Omar Ortiz — Wan 2.7 Image Pro
  • Promptus AI — Z-Image nasuprot Fluxu 2
  • TensorArt — HunyuanVideo 1.5
  • AI Search — rangiranje HunyuanVidea 1.5
  • Alibaba Cloud (službeno) — najava Qwen-Imagea-2.0
  • kintu — recenzija Qwen-Imagea-2.0
  • fal (fal Academy) — objašnjenje LTX-a 2

Broj pretplatnika ni jednog kanala nije potvrđen jer je dohvaćanje stranica videa bilo ograničeno (vidi Ograničenja).

Videozapisi
Trendovi zatvorenih modela
  1. Kling 3.0: The Best AI Video Generation I've Ever Seen (Truly Incredible) — Paul J Lipsky — https://www.youtube.com/watch?v=p6cV7PitAvg — Kuaishouov „Kling 3.0” ocijenjen je kao najbolji dosad viđeni model zbog filmskog generiranja s više kadrova, nativnog zvuka i sinkronizacije usana te dosljednosti likova.
  2. Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN — Theo - t3gg — https://www.youtube.com/watch?v=UV9GqinedQ8 — tvrdi se da je Googleov Nano Banana Pro (Gemini 3 Pro Image) gotovo bez konkurencije u generiranju slika.
  3. Google's Nano Banana Pro is raising concerns over realistic AI image generation — NBC News — https://www.youtube.com/watch?v=RmmrVCUGYp8 — opći informativni kanal izvještava o riziku zloupotrebe zbog realističnosti Nano Banana Proa.
  4. OpenAI's Sora 2 Just SHOCKED The Entire Industry! (10 Things To Know About Sora 2) — TheAIGRID — https://www.youtube.com/watch?v=y4RCSU6SsA0(2025-10-01) — objašnjava točnost fizikalne simulacije Sore 2 (gimnastika, trostruki skokovi i slično) te učinak aplikacije u stilu društvene mreže.
  5. Sora 2 Just Got An Update.....And? — OpenArt — https://www.youtube.com/watch?v=WmJrfuY8BXc — skeptična procjena da ažuriranje Sore 2 nije donijelo očekivani napredak.
  6. OpenAI is shutting down its Sora video creation app — NBC News — https://www.youtube.com/watch?v=6e3SINmPii4(2026-03-25) — izvještaj o zatvaranju samostalne aplikacije Sora, uz zabrinutost zbog deepfakeova.
  7. OpenAI Shuts Down Sora After Losing Billions — Wall Street Millennial — https://www.youtube.com/watch?v=ZkRYH6PEP5k — analiza povlačenja Sore iz perspektive velikih financijskih gubitaka.
  8. FLUX 3 Is Here — Everything You NEED to Know — ElevenLabs — https://www.youtube.com/watch?v=WlGmDRLZt9o(odmah nakon najave 2026-07-23) — izričito kaže da je FLUX 3 Black Forest Labsa, koji objedinjuje sliku, video, zvuk i predviđanje radnji, „gated early access” i trenutačno nije otvoreni kod.
  9. ByteDance Seedance 2.5: 30-Second AI Video Generation with 50 Reference Inputs — ApiTechTips — https://www.youtube.com/watch?v=O2KNqKLANtQ — predstavljanje Seedancea 2.5, najavljenog na Volcano Engine FORCE događaju 2026-06-23: generiranje od 30 sekundi, 4K i zatvoreni API.
  10. GRATIS Grok Imagine 0.9. Crea videos en 20 segundos. — LLM Master — https://www.youtube.com/watch?v=ScWkfsrDAkw — objašnjava da je xAI-jev Grok Imagine v0.9 svim korisnicima besplatno otvorio generiranje videa sinkroniziranog sa zvukom.
  11. ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs(2026-07) — analiza najave Seedreama 5.0 Pro, novog slikovnog modela koji omogućuje djelomično uređivanje po slojevima.
Trendovi otvorenih modela
  1. Wan 2.6 Just Changed AI Video Forever 😱 — Codedigipt — https://www.youtube.com/watch?v=gYcMhT-eZ_A(2025-12-16) — prikazuje kako Alibaba Wan 2.6 održava identitet likova i automatski dijeli jedan prompt na više kutova kamere.
  2. Wan 2.6 is HERE! R2V is AWESOME! — Sebastian Kamph — https://www.youtube.com/watch?v=dGDIpQz_l-E(2025-12-21) — demonstracija mogućnosti Reference-to-Video (R2V), uz naglasak da je riječ o otvorenim težinama pod licencom Apache.
  3. Taking Wan 2.7 For A Ride! Here's What I Found Out — OpenArt — https://www.youtube.com/watch?v=RERsGjQrQ6E(2026-04) — praktična recenzija Wana 2.7; uspoređuje se s Klingom 3 i Veom 3.1 te cijene besplatnost i nepostojanje cenzure.
  4. Wan 2.7 Image Pro: The AI Image Model Nobody Saw Coming — Omar Ortiz — https://www.youtube.com/watch?v=GIMVt4vCv20(2026-05) — ističe se da Wan, uz video, naglo jača i u generiranju slika.
  5. Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Alibaba Tongyi-MAI Z-Image-Turbo pod licencom Apache 2.0 prikazan je kao konkurent razine Nano Banana Proa.
  6. New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — Promptus AI — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — benchmark usporedba u kojoj se tvrdi da Z-Image nadmašuje Flux 2.
  7. Tencent HunyuanVideo 1.5 has been officially open-sourced! — TensorArt — https://www.youtube.com/watch?v=MJShdc8tkkA(2025-12) — objašnjava se da DiT model s 8,3B parametara radi na potrošačkom GPU-u s 14 GB VRAM-a i da ga je pod Apache 2.0 licencom moguće koristiti komercijalno.
  8. We have a new #1 open-source AI video generator! — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — HunyuanVideo 1.5 pozicioniran je kao novi prvak otvorenog generiranja videa.
  9. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Alibaba Cloud (službeni kanal) — https://www.youtube.com/watch?v=NGkwBn0ebYk(2026-02-10) — primarna najava modela sa 7B parametara koji objedinjuje generiranje i uređivanje, s izvornom 2K rezolucijom i poboljšanom tipografijom.
  10. "Qwen Image 2.0 Review: Insane Image & Text Rendering + Editing Beast!" — kintu — https://www.youtube.com/watch?v=dxLDvd1a_Sk(2026-02-16) — neovisna provjera kvalitete prikaza teksta i mogućnosti uređivanja Qwen-Imagea-2.0.
  11. LTX-2 Is Here - Native Audio AND Open-Source! | fal Academy — fal — https://www.youtube.com/watch?v=Odkj4zllsZg — Lightricksov LTX-2 predstavljen je kao prvi model s otvorenim težinama koji u istom prolazu sinkronizirano generira zvuk i sliku, s izvornim 4K/50 fps-om i javno dostupnim kodom za treniranje.
Signali
  • Otvoreni modeli imaju glavno uporište u Kini (Alibaba Wan/Qwen/Tongyi-MAI, Tencent Hunyuan) i Izraelu (Lightricks LTX-2). Kanali ih redovito uspoređuju sa zatvorenim modelima pomoću ključnih riječi „Apache 2.0”, „besplatno” i „necenzurirano”. Naslovi često koriste izraze poput „DESTROYS” i „Nobody Saw Coming”, što pokazuje da otvoreni modeli privlače pozornost stvarnom kvalitetom.
    U 2026. godini videozapisi s recenzijama novih otvorenih modela — Wan 2.6→2.7, HunyuanVideo 1.5, Z-Image (Turbo), Qwen-Image-2.0 i LTX-2 — izlaze gotovo mjesečno.
  • Kod zatvorenih modela mnoštvo se igrača natječe za prvo mjesto: Google (Nano Banana Pro), OpenAI (Sora 2), Kuaishou (Kling 3.0), ByteDance (Seedance/Seedream), xAI (Grok Imagine) i Black Forest Labs (FLUX 3) svi ističu plasman broj jedan na arenama. Ipak, povlačenje samostalne aplikacije Sora u ožujku 2026. (NBC News, Wall Street Millennial) pokazuje da se i zatvoreni igrači bore s monetizacijom.
  • FLUX 3 je tema na granici zatvorenog i otvorenog. Black Forest Labs bio je poznat po pristupu otvorenih težina, ali FLUX 3 je „gated early access”; i objašnjenje ElevenLabsa posebno ističe tu činjenicu. To signalizira da zajednica prati povlačenje od otvorenosti.
  • Kanali s recenzijama (Codedigipt, OpenArt, Sebastian Kamph, Promptus AI) nakon svakog novog modela objavljuju usporedbe otvorenih i zatvorenih proizvoda u istom formatu. Iz naslova se vidi da gledatelji biraju manje prema platformi, a više prema pitanju „što je besplatno, a što je kvalitetnije”.
Ograničenja
  • Nije bilo moguće potvrditi ni broj pregleda ni broj pretplatnika. Kada se youtube.com/watch?v=... dohvaćao preko WebFetcha, vraćao se samo navigacijski sadržaj YouTubeova podnožja (uvjeti, autorska prava i slično) uz napomenu da je sadržaj predugačak i skraćen. Nije se moglo doći do glavnih podataka, uključujući preglede, datum objave i broj pretplatnika.
  • Kao alternativa, naslov i naziv kanala provjereni su preko youtube.com/oembed?url=...&format=json, službenog YouTube API-ja. Datumi su često procijenjeni iz isječaka WebSearcha i sekundarnih izvora, a ne potvrđeni na samoj stranici videa. Datumi koji nisu potvrđeni izostavljeni su iz teksta.
  • Pokušaj korištenja Invidious zrcala (yewtu.be) završio je stranicom za bot provjeru (CAPTCHA), bez sadržaja. Pokušaj internog API-ja s parametrom pbj=1 vratio je samo prazan JSON.
  • Budući da glavna stranica videa nije bila dostupna, komentari, uključujući najpopularnije komentare, nisu provjeravani.
  • Pretraga preko WebSearcha s site:youtube.com dosljedno je vraćala oko deset poveznica po upitu, za razliku od potpuno nedostupnog Reddita. Videozapisa ima mnogo; odabranih 11+11 samo su reprezentativni primjeri i namjerno su ograničeni na raspon od 5–12 po kategoriji koji određuje playbook. Zahtjev briefa o približno 20 analiza smatra se ispunjenim s 22 potvrđena naslova, kanala i opisa sadržaja.

Bluesky

Bluesky — vijesti o AI-ju za generiranje slika i videa

Službeni Bluesky API za pretragu (public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) iz ovog je okruženja svaki put vraćao 403 Forbidden. Sam bsky.app je SPA aplikacija prikazana JavaScriptom pa ni izravnim otvaranjem nije bilo moguće dohvatiti tekst objava ni broj lajkova i repostova (detalji u odjeljku ## Ograničenja). Zato su stvarne objave skupljene iz fragmenata bsky.app stranica koje je Google indeksirao preko WebSearcha. Za aktualna imena modela iz druge polovice 2026. — Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3, GPT Image 2, MAI-Image-2.6, Z-Image-Turbo — nije pronađena nijedna objava na Blueskyju. U odnosu na X, Bluesky gotovo da nije prisutan u razgovoru o ovoj temi.

Računi
  • @simonwillison.net — neovisni istraživač koji prati LLM-ove i generativni AI općenito; slikovne modele povremeno spominje, ali nisu mu glavna tema.
  • @todaystopainews.bsky.social — bot/agregator koji automatski prikuplja i objavljuje AI vijesti.
  • @civitai-bot.bsky.social (bot za ažuriranja CivitaiCheckPointa) — automatski objavljuje nove i ažurirane checkpointove na Civitaiu; jedini stalni račun koji prati ekosustav otvorenih Stable Diffusion modela.
  • @doctordiffusion.bsky.social — individualni kreator koji objavljuje Stable Diffusion modele na Civitaiu.
  • @luok.ai — individualni račun koji spominje otvorene video modele SkyReels (Skywork AI).
  • @dahara1.bsky.social — individualni račun koji na japanskom dijeli iskustva s beta-testiranjem generativnog AI-ja.
  • @valeoai.bsky.social (Valeo.ai) — službeni račun koji otvara istraživanja video/svjetskih modela za autonomnu vožnju; usmjeren je na akademski otvoreni kod, ne na izravno generiranje slika i videa.
  • @midjourney.bsky.social — službeni Midjourneyjev profil postoji, ali pretraga nije pronašla nedavne objave.
  • @opensource.bsky.social (Open Source Initiative) — obrazovni račun o otvorenom kodu općenito, nije specijaliziran za generativni AI.
  • Službeni Bluesky računi Alibabe (Wan/Qwen-Image), Tencenta (Hunyuan), Klinga/Kuaishoua, Black Forest Labsa, Runwaya, xAI-ja, OpenAI-ja i drugih laboratorija koji su primarni izvori na X-u nisu potvrđeni.
Objave
Zatvoreni modeli
  1. Otkrivanje SynthID-a u Nano Banana Prou@simonwillison.net: spominje da se pri učitavanju fotografije radi provjere je li AI-generirana može otkriti nevidljivi vodeni žig SynthID koji ugrađuje Nano Banana Pro. Datum nije poznat (pretpostavlja se 2026.). Broj lajkova/repostova nije dostupan.
  2. Konvergencija API dobavljača i uporaba FLUX-a@simonwillison.net: ističe da vodeći LLM API dobavljači usklađuju mogućnosti poput izvršavanja koda, pretraživanja weba, biblioteka dokumenata, generiranja slika i MCP-a; u tom kontekstu spominje „image generation (FLUX for Mistral)”, odnosno Mistralovu uporabu FLUX-a Black Forest Labsa. Datum nije poznat.
  3. Konkretan kreativni rad uz Kling AI 1.6@planet-gay-comic.bsky.social (2025-02-07): autor rada „Spring Feelings Arise” navodi da je Kling AI 1.6 koristio za pretvorbu slike u video, SD-1.5 za statične slike, a Suno AI v4 za zvuk. To je konkretan primjer uklapanja zatvorenog alata za generiranje videa u kreativni rad pojedinca.
  4. Komentar o budućnosti Groka@wilkos.bsky.social (2026-06-05): „Grok will lead the way in frontier models by training off more established and capable competitors.” Nije riječ o sadržaju specifičnom za generiranje slika ili videa, već samo o općoj referenci na Grokove napredne modele.
Otvoreni modeli
  1. Širenje poruke o „necenzuriranom lokalnom AI-ju za slike”@todaystopainews.bsky.social (2026-06-30): automatska AI vijest „New top local AI image generator is here! Already uncensored”. Radi se o prenošenju YouTube videa o lokalno pokretanom slikovnom modelu s otvorenim težinama, a ne o primarnoj informaciji.
  2. Objava SkyReelsa V1@luok.ai (2025-02-18): „SkyReels V1 is the first open-source human-centric video foundation model”, najava otvorenog osnovnog video modela Skywork AI-ja. Temeljen je na HunyuanVideu i treniran na 33 vrste izraza lica i više od 400 prirodnih pokreta.
  3. Iskustvo beta-testiranja HunyuanVidea@dahara1.bsky.social (2025-03-06): na japanskom izvještava o sudjelovanju u beta-testu HunyuanVidea i mogućnosti stvaranja videa iz jedne slike (I2V), uz testiranje na anime materijalima.
  4. Automatsko ažuriranje Civitai checkpointa@civitai-bot.bsky.social (2024-05-07): bot automatski najavljuje ažuriranje „Dream Come TrueXL v4.0”, modela iz obitelji SDXL/SD1.5. Pokazuje da zajednica otvorenih SD modela na Civitaiu i dalje postoji na Blueskyju u obliku automatiziranih objava.
  5. Distribucija Civitai modela@doctordiffusion.bsky.social (2025-01-19): dijeljenje vlastitog Stable Diffusion modela s poveznicom na Civitai.
  6. Otvaranje video/svjetskog modela za autonomnu vožnju@valeoai.bsky.social (2025-02-24): uz poruku „Trained on YouTube?! We used OpenDV” objavljeni su rad (arXiv:2502.15672), stranica projekta, GitHub kod, istrenirane težine, recept za treniranje i zakoni skaliranja. Nije izravno model za generiranje slike ili videa, već svjetski model bliži razumijevanju videa, ali je koristan primjer tvrtke koja je otvorila cijeli paket, uključujući težine.
Signali
  • Pretraga ne vraća apsolutno ništa za aktualne modele iz 2026.: više od 20 upita za Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3, GPT Image 2, MAI-Image-2.6, Z-Image-Turbo, HunyuanImage 3.0, Runway Gen-4.5 i druge modele koji su aktivna tema na X-u nije pronašlo nijednu Bluesky objavu. Razgovor o ovoj temi na Blueskyju gotovo je potpuno odvojen od ciklusa vijesti na X-u.
  • Nema službenih računa laboratorija: nisu potvrđeni službeni Bluesky računi Alibabe (Wan/Qwen), Tencenta (Hunyuan), Kuaishoua (Kling), Black Forest Labsa, Runwaya, xAI-ja ni OpenAI-ja koji bi, kao na X-u, objavljivali primarne informacije. Sam put kojim bi najave stigle na Bluesky zapravo ne postoji.
  • Pronađene teme su uglavnom zapadne, vezane uz Stable Diffusion/Civitai i stare: najveći dio pronađenih objava potječe iz 2024. i prve polovice 2025. te se koncentrira oko hobističkih zajednica Civitai i Stable Diffusion, odvojeno od konkurencije koju 2026. predvode kineski laboratoriji (Wan/Qwen/Hunyuan/Z-Image).
  • Kulturni otpor na platformi: Blueskyjev kurator umjetničkih feedova bSky.art uveo je popise za isključivanje AI-ja iz feedova poput „Trending”, a sam Bluesky navodi da sadržaj korisnika uopće ne koristi za treniranje generativnog AI-ja. Kultura koja aktivno ne promiče AI-generirani sadržaj vjerojatno pridonosi slabom razvoju razgovora u ovoj domeni.
  • Malo novijih tema dolazi preko botova, ne primarnih izvora: rijetke objave o novim modelima, poput računa todaystopainews.bsky.social, samo prenose YouTube videe i ne dolaze od programera modela.
  • Sporadične reference poznatih AI komentatora koji su migrirali s X-a: poznati komentatori poput Simona Willisona sliku i video spominju tek povremeno u širem razgovoru o LLM-ovima, a ne prate ih specijalizirano.
Ograničenja
  • Službeni Bluesky API za pretragu https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts vraćao je 403 Forbidden pri izravnom pristupu i preko više CORS proxyja (allorigins.win, corsproxy.io, codetabs.com i drugi); ponegdje je vraćen 522. Tekstovi objava, lajkovi, repostovi i datumi nisu se mogli dohvatiti preko API-ja.
  • Stranice pretrage, profila i trajne poveznice pojedinačnih objava na bsky.app JavaScript su SPA stranice. Dohvaćen je samo prazan omotač aplikacije s naslovom „Bluesky” ili „@handle on Bluesky”. Stoga su sve objave u ovom izvješću rekonstruirane iz isječaka koje je WebSearch indeksirao preko Googlea, a broj lajkova i repostova nije dobiven ni za jednu objavu.
  • Zbog tih ograničenja indeks pretraživača je slab, a za aktualne teme praktično ne daje rezultate. Svi upiti za modele iz 2026. završili su bez rezultata, pa su pronađene samo objave iz 2024. i 2025. To nije dokaz da na Blueskyju nema vijesti, nego vjerojatno odražava ograničenje pristupa kroz indeks pretrage.
  • Kriterij od približno 20 analiziranih objava nije bilo moguće ispuniti samo za Bluesky jer je izravan pristup stvarnim podacima blokiran. Gore navedenih deset objava (4 zatvorene, 6 otvorenih) sve su koje je bilo moguće potvrditi iz ovog okruženja; za veći opseg potrebna je prijava u službenu aplikaciju ili drukčiji API pristup.

Lemmy

Lemmy — istraživanje vijesti o AI-ju za generiranje slika i videa

Zajednice
  • !«メールアドレス» (oko 5.600–5.700 članova) — sve teme o slikovnim i video modelima s otvorenim težinama. Svakodnevno se pojavljuju ComfyUI prilagođeni čvorovi i novi modeli s Hugging Facea; ovo je bilo najkorisnije mjesto u istraživanju.
  • !«メールアドレス» (2.359 članova) — objave radova nastalih Stable Diffusionom i modelima s otvorenim težinama.
  • !«メールアドレス» (1.593 člana) — AI umjetnost u anime stilu, samo SFW sadržaj.
  • !«メールアドレス» (1.662 člana) — rasprave o SD-u kao „open-source deep learning modelu”.
  • !«メールアドレス» (52 člana), !«メールアドレス» (50 članova), !«メールアドレス» (102 člana), !«メールアドレス» (96 članova) — male zajednice po specifičnim temama.
  • !«メールアドレス» (222 člana) — zrcalo ili zasebna zajednica u odnosu na lemmy.dbzer0.com; ima manje objava.
  • !«メールアドレス», !«メールアドレス», !ai_reddit (na raznim instancama), !«メールアドレス» — ovdje se pojavljuju vijesti o zatvorenim AI-jima (Grok, Sora, Nvidia DLSS i sl.) te protuaAI raspoloženje. Broj pretplatnika nije javno dostupan ili se znatno mijenja.
Objave
  1. OpenAI gasi Sorau, a film od 30 milijuna dolara propada (!ai_reddit, 2026-05-27, ocjena 1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/ . Objavljeno je da je AI filmski projekt u produkciji propao zbog završetka aplikacije i API-ja Sora 2 (prekid API-ja planiran je za 2026-09-24). Povezano: „How OpenAI scrapping Sora points to tech problems” (!openai, 2026-04-13) https://timesofindia.indiatimes.com/technology/ i „Why OpenAI abandoned Sora” (!kagismallweb, 2026-04-03) https://onemanandhisblog.com/2026/03/ .
  2. Objavljeno da je generiranje slika xAI-jevim „Grokom” korišteno za 7.000 seksualnih slika vlastitog djeteta, a xAI je tužen zbog generiranja CSAM-a (!«メールアドレス», „Child sexual abuse survivor alleges Elon Musk's AI chatbot used photos of her to generate new illegal images”, krajem kolovoza 2026., ocjena 119) — https://lemmy.world/post/51492879 . Najpopularniji komentar kritizira strukturu u kojoj milijarderi ne snose odgovornost.
  3. Američki savezni sudac zaključuje da je AI-generirani materijal seksualnog zlostavljanja djece zaštićen Prvim amandmanom (!technology, 2026-08-30, ocjena 16) — https://reason.com/volokh/2026/08/27/ . Vijest relevantna za pravne granice generativnog AI-ja, bez obzira na to je li model zatvoren ili otvoren, prenesena je na više instanci, uključujući !«メールアドレス».
  4. Nvidia DLSS 5, AI filtar za poboljšanje slike uz pad performansi od 50–60% (!«メールアドレス», 2026-09-02–09-03, ocjena 21) — https://www.pcgamer.com/hardware/graphics-cards/dlss-5-comes-with-a-massive-50-60-percent-performance-hit/ . U isto vrijeme raspravljalo se i o objavama „Nvidia Announces DLSS 5...An AI slop filter over your game” https://lemmy.world/post/44347792 i „Experimental Build Of Nvidia's DLSS 5 AI Slop Filter Leaks...” https://lemmy.world/post/51240561 .
  5. Objavljen Google Nano Banana 2 Lite (!swisstechnews, 2026-07-02; !hackernews prijenos 2026-06-30) — https://www.itmagazine.ch/artikel/87529/ , https://deepmind.google.com/models/ . Predstavljen je kao lagani slikovni model iz serije Gemini 3.
  6. Microsoftov „MAI-Image-2.5” sustiže Nano Bananu (!ai_reddit, 2026-05-28, ocjena 1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/ . Riječ je o Microsoftovu vlastitom zatvorenom slikovnom modelu kao odgovoru Googleu.
  7. Usporedna recenzija realističnih slika ByteDance Seedreama 5.0 Pro (!ai_reddit, 2026-07-10, ocjena 1) — https://www.reddit.com/gallery/1usc03q .
  8. Adobe Firefly u javnoj beti (!swisstechnews, 2026-04-28) — https://www.itmagazine.ch/artikel/87034/ . Traje i rasprava o AI chatbotu u Photoshopu, AI maskiranju i generativnom zvuku u Fireflyju (!boycottus, 2025-10-29, ocjena 22 https://alternativeto.net/news/2025/10/adobe-adds-ai-chatbots-to-photoshop-premiere-ai-masking-and-generative-audio-in-firefly/ ).
  9. Rasprava „Koliko se trebamo bojati AI deepfakeova?” (!«メールアドレス», oko 2026-05-20, ocjena 21) — https://lemmy.world/post/47088326 . Autor je zbog zaštite od deepfakeova uklonio sve vlastite fotografije s interneta; komentari ističu da rizik ovisi o položaju osobe te da su žene izloženije većem riziku.
  10. Objava otvorenih težina MiniMax H3 (Hailuo 3.0) i ComfyUI-jeva ekskluzivna prodaja komercijalne licence (!«メールアドレス», „ComfyUI MiniMax H3 Commercial Licensing”, 2026-08-28, ocjena 4) — https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . Težine su otvorene (MiniMax Community License; komercijalna uporaba dopuštena je tvrtkama s godišnjim prihodom manjim od 20 milijuna USD), ali Comfy ekskluzivno prodaje komercijalnu licencu i usluge implementacije. To je „komercijalni model s okusom otvorenosti”. Jedan transformer obrađuje tekst, sliku, video i zvuk; izlaz je do 15 sekundi, 2K i nativni stereo zvuk. Pojavile su se i brojne povezane objave alata (MiniMax-H3-Acc-LoRAs, MotionCache-FastVAE, Director-Cut-Studio i drugi, od 2026-08-28 do 09-02).
  11. Niz ComfyUI čvorova za LTX-2.3 / LTX-2.5, otvorene video modele Lightricksa (!stable_diffusion, 2026-08-27–09-01) — primjer: https://github.com/nazgut/ComfyUI-LTX2.3-CLSS . LTX-2.5 je video model s otvorenim težinama od 22B parametara i zvukom, s generiranjem više kadrova i 4K HDR izlazom; prije dolaska H3 bio je vodeći otvoreni video model.
  12. Trellis.2 i Pixal3D dobivaju nativnu podršku u ComfyUI-ju (!stable_diffusion, 2026-09-01, ocjena 4) — https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native . ComfyUI ekosustav sada objedinjuje i 3D generiranje, ne samo slike i video.
  13. Objavljen Boogu-Image-0.1 (!stable_diffusion, 2026-06-17, ocjena 5) — https://boogu.org/ . Model s 10B parametara potpuno je otvoren pod licencom Apache-2.0, visoko se plasira na Qwen-Image-Benchu i ima varijante Base, Turbo i Edit. Predstavlja se kao dokaz da se uz mali računalni proračun može postići kvaliteta usporediva sa zatvorenim modelima.
Signali
  • Raspoloženje oko zatvorenih modela: središte razgovora nisu toliko najave novih modela koliko „kontroverze, tužbe i povlačenja”. Povlačenje Sore, Grokova tužba za CSAM i kritike pada performansi DLSS-a 5 dobivaju više bodova (DLSS 5: 21, Grokova tužba: 119). U zajednicama poput !«メールアドレス» snažan je protuaAI stav.
  • Raspoloženje oko otvorenog koda: !«メールアドレス» u praksi djeluje kao dnevnik ažuriranja ComfyUI ekosustava. Novi prilagođeni čvorovi i LoRA-i za MiniMax H3, LTX-2.3/2.5, Flux i Qwen Image pojavljuju se gotovo svakodnevno. Više je objava alata za programere nego prikaza gotovih radova, što pokazuje praktičnu orijentaciju zajednice.
  • Granica otvoreno/zatvoreno postaje nejasna: MiniMax H3 ima otvorene težine, ali Comfy ekskluzivno prodaje komercijalne licence, što pokazuje raspad jednostavne podjele na dva tabora.
  • Lemmy općenito sadrži mnogo prijenosa iz Reddit zajednica poput !ai_reddit; najviše izvornih objava kao primarni izvor nalazi se u !«メールアドレス».
Ograničenja
  • Lemmy ima manju korisničku bazu od X-a, YouTubea i Reddita, a nije pronađena zajednica posvećena isključivo AI-generiranju videa (poput !video_generation). Video teme uglavnom su skrivene među alatnim objavama u Stable Diffusion zajednicama, primjerice za LTX, MiniMax H3 i WanGP.
  • Globalni API za pretragu Lemmyja za neke upite nije vraćao rezultate (primjerice samo video generation, ili pojedinačne upite Ideogram, Seedream, Qwen Image), pa nije moguće razlikovati nepostojanje objava od ograničenja indeksa pretrage.
  • Broj pretplatnika razlikuje se po instanci i izvoru: za !«メールアドレス» prikazane su vrijednosti 5,05K, 5,64K i 5.707. Zbog federativne naravi mreže nije moguće dobiti jedan potpuno točan broj.
  • Stranica zajednice lemmy.world/c/stable_diffusion_art vraćala je poslužiteljsku pogrešku HTTP 500; popis objava nadomješten je informacijama iz API pretrage.
  • Nije bilo moguće potpuno detaljno analizirati 20 konkretnih objava na jednoj platformi. Izvješće navodi 13 pažljivo odabranih, stvarnih objava i poveznica potvrđenih API pretragom i WebSearchom; nisu uključene izmišljene poveznice.

Pinterest

Pinterest — vijesti o AI-ju za generiranje slika i videa (zatvoreni izvor / otvoreni izvor)

Od 50 prikupljenih Pinova (output/pinterest.pins.md), 32 su otvorena i pregledana kao slike (jedan skup rezultata bez podjele po žanrovima).

Vizualne teme
  • Najzastupljenije su clickbait naslovnice s YouTubea. Ponavljaju se naslovi velikim podebljanim slovima, fotografije kreatora s iznenađenim izrazom i sjajne robotske glave u neonskoj plavoj i ljubičastoj. YouTube naslovnice s tekstovima poput „huge AI news”, „AI NEWS” i „15 Biggest AI Updates” prenesene su izravno na Pinterest [1, 6, 8, 13, 14, 26, 47].
  • Mnogo je infografika za usporedbu „Top N alata”, uz ponavljanu uporabu istog predloška. [16] i [40] imaju identičan raspored „BEST QUALITY(PAID) vs BEST FREE”: ChatGPT Plus/Gemini Advanced/Midjourney/Adobe Firefly/Recraft/Runway Gen-3/Luma/Pika Pro/Kaiber/Synthesia u lijevom stupcu, te Ideogram/Gemini Free/SeaArt/Playground/Krea/Canva/Inkscape/CapCut/Pika Free/Runway Free u desnom. Razlikuju se samo boje i vodeni žig računa „DA”, što ukazuje na umnažanje predložaka, a ne informacija. Drugi primjeri također se ne podudaraju: [10] nosi naslov „Top AI Video Generators of 2025”, ali je slika zapravo kolaž u stilu filmske moodboard ploče; [42] ima općenit naslov „Video generation 📹”, dok je slika rang-lista „TOP 10 IMAGE-TO-VIDEO GENERATOR TOOLS” s istaknutim Runwayjem (Kling, Google Veo, Sora, Luma, Pika, Kaiber, Synthesia, HeyGen, Adobe Firefly, InVideo).
  • Tamna mornarskoplava i neonskoplava paleta „tehnološke budućnosti” koristi se za opće edukativne AI grafike, a ne za konkretne vijesti. Svjetleći mozgovi, uzorci sklopova i ikone robotskih glava koriste se kao opći simboli AI-ja, ne samo za generiranje videa ili slika [2, 12, 30, 32, 36, 49].
  • Demonstracijske slike stvarnih proizvoda su rijetke, ali konkretnije. Tu su kolaž više scena Google Vea 2 s pozivom „Sign up to try on VideoFX” [5], Veo 3 image-to-video putem Gemini API-ja s lijevkom slika + tekst → brzo generiranje [9], Microsoft VASA-1 s mrežom talking-head videozapisa različitih izraza iz jedne slike i zvuka [18], ShengShu Vidu S1 s anime sučeljem i tvrdnjom o vodećem modelu za interaktivnu generaciju u stvarnom vremenu [25], AMD Amuse 3.0 s realističnim portretom starog ribara označenim kao „AI generated image created on AMD Ryzen AI”, što je rijetko spominjanje lokalne/on-device generacije [33], te demonstracija promjene stila nalik Luminateu [3], koja isti izvorni video mijenja u stil „drvenih blokova”, „origami umjetnosti”, „šarenih blok-igračaka” i „cvijeća”, kao i izgled Tesle Model 3 i glave pande.
  • Vidljiva je zabrinutost zbog deepfakeova i otkrivanja lažnog sadržaja. Primjeri uključuju sliku mačke s lažnim brojkama angažmana (1,2K lajkova i 7,4K pregleda) i crvenim pečatom „FAKE” [1], sučelje za detekciju zvuka s porukom „97% likely AI generated” i prikazom ljudskog/kiborg oka [12], te tablicu „Good or Bad?” koja uspoređuje prednosti AI videa (ušteda vremena, manji trošak, visoka kvaliteta) i nedostatke (manjak ljudske kreativnosti i emocionalne povezanosti, pretjerana ovisnost) [19].
  • Infografike iznose brojke o veličini tržišta i rastu bez jasnog uporišta. Primjeri su „AI Video Generator Market: USD 2.56B by 2032, CAGR 20%” [48] te popis „6+ Best AI Video Generation Websites” (Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI), uz predviđanje da će do 2026. 80% mrežnog sadržaja uključivati video [6].
  • Pinovi oglasa za „AI voditelje vijesti” i „AI kanale bez lica”. Ne radi se o vijestima, nego o promotivnim naslovnicama usluga za izradu videa u stilu informativne emisije uz AI sinkronizaciju usana [46].
Značajni Pinovi
  • [3] Usporedna demonstracija koja izvorni video pretvara u četiri stila — drvene blokove, origami, Lego i cvijeće — te pokazuje promjenu izgleda Tesle i glave pande. Među pregledanim Pinovima to je najkonkretniji dokaz generiranja videa uz prijenos stila.
  • [5] Slika lansiranja Google Vea 2. U jednoj slici prikazuje šest potpuno različitih scena, uključujući mikroskopsku scenu, plivača pod vodom, djevojku u anime stilu i flaminga, uz poruku „Sign up to try on VideoFX”.
  • [9] Veo 3 image-to-video preko Gemini API-ja. Grafika u obliku lijevka vodi od ulazne slike i teksta do brzog generiranja i upućuje na podršku za nativni zvuk.
  • [18] Microsoft VASA-1. Mreža pokazuje da se iz jedne fotografije i zvučnog isječka može proizvesti talking-head video s više od deset izraza lica.
  • [25] ShengShu Vidu S1. Promotivna slika anime lika tvrdi da je riječ o „svjetski vodećem modelu za AI video interakciju u stvarnom vremenu”.
  • [28] Infografika „15 Biggest AI Updates”. Jedan od rijetkih Pinova koji navodi konkretna izdanja iz područja generiranja slika, uključujući funkcije uređivanja i promjene veličine u Grok Imagine Image 2.0 te pojeftinjenje API-ja DeepSeek V4 Pro.
  • [32] Statistička kartica „Google je analizirao 15 milijuna chatova”. Navodi da je 86% uporabe AI-ja izvan posla i anegdotu da se AI agent u natjecanju programiranja plasirao iznad 458 od 526 timova.
  • [1] Slika mačke s pečatom „FAKE” i izmišljenim brojkama angažmana. Ona simbolizira nepovjerenje prema deepfakeovima koje se provlači kroz cijelu skupinu Pinova.
  • [33] AMD Amuse 3.0. Realistični portret s oznakom da je generiran na AMD Ryzen AI-ju; to je jedino spominjanje lokalnog/on-device generiranja u istraženim Pinovima.
  • [16]/[40] Isti dijagram usporedbe AI alata „Best Quality (plaćeno) vs Best Free (besplatno)” pojavljuje se dvaput, s različitim bojama i računima — nalaz koji pokazuje umnažanje predložaka, a ne sadržajnu vrijednost.
Signali
  • Veliki zatvoreni brendovi — Google Veo, OpenAI Sora, Runway, Kling, Pika, Luma, Midjourney, ChatGPT/DALL-E, Adobe Firefly i Synthesia — neprestano se imenuju u Pinovima za usporedbu „Top alata” i dominiraju takvim sadržajem na Pinterestu ([6, 10, 16, 24, 40, 42] i drugi).
  • Pinovi koji se predstavljaju kao otvoreni kod gotovo ne postoje. Među 32 pregledane slike nije pronađen nijedan prikaz Stable Diffusiona, Fluxa, Wana, HunyuanVidea ili ComfyUI radnih tokova. Jedini sadržaj koji se može opisati kao lokalni/on-device je AMD Amuse 3.0 [33], no riječ je o korporativnom lokalnom alatu, ne strogo o otvorenom kodu.
  • Naslovi Pinova često se ne poklapaju sa stvarnim sadržajem slika. Pinovi poput „Google announces...” [3] ili „Google announces video generation AI 'Veo 3'” [37, vidi Ograničenja] nose poznato ime, ali slika ne sadrži Googleov logo ni druge dokaze. Naslovi su vjerojatno prenapuhani radi SEO-a ili klikova.
  • Sadržaj koji se predstavlja kao „vijest” često je generički predložak za višekratnu uporabu. „Breaking News” maketa [30] navodi već etablirana imena poput GPT-5, Llama 3.1 i Claude 3.5, što upućuje na trajni predložak kojem se datum ne ažurira.
  • Sveukupno, Pinterest sadržaj o ovoj temi više služi za prodaju i usporedbu AI alata, poticanje straha od AI-ja ili sekundarnu distribuciju YouTube naslovnica nego za prenošenje vijesti. Za aktualne informacije X i YouTube puno su bliži primarnim izvorima.
Ograničenja
  • Od 50 prikupljenih Pinova, kao slike su pregledani njih 32 ([1, 2, 3, 5, 6, 8, 9, 10, 12, 13, 14, 16, 18, 19, 20, 24, 25, 26, 28, 29, 30, 32, 33, 36, 37, 40, 41, 42, 46, 47, 48, 49]). Preostalih 18 ([4, 7, 11, 15, 17, 21, 22, 23, 27, 31, 34, 35, 38, 39, 43, 44, 45, 50]) nije pregledano.
  • pinterest.pins.md nema podjelu po žanrovima (## <genre> odjeljke); svih 50 stavki navedeno je kao jedan skup rezultata pretrage, pa se ne može napraviti zbroj po žanrovima.
  • Pin [37] pod naslovom „Google announces video generation AI 'Veo 3'” pri otvaranju je zapravo pokazivao ljubičasto čudovište koje se iz ulazne slike pretvara u video u tri okruženja — poslužiteljskoj sobi, podvodnim ruševinama i gradu od slatkiša. Nije bilo Googleova brendiranja ni logotipa Vea 3. Tvrdnja iz naslova nije podržana slikom, stoga nije uzeta kao činjenica.
  • Analizirane su samo slike Pinova; stvarni broj spremanja, komentari, datum objave i drugi pokazatelji angažmana nisu bili dostupni ni na Pinterestu ni u pinterest.pins.md.
  • Od zahtjeva briefa za najmanje deset uvida o zatvorenim i najmanje deset o otvorenim modelima, Pinterest praktično nije pružio izravne uvide o otvorenom kodu. AMD Amuse 3.0 [33] jedina je donekle relevantna stavka. Trendove otvorenog koda treba nadopuniti s X-a, Reddita i Lemmyja.

Preporučene aktivnosti

  • Kontinuirano pratiti X i YouTube kao primarne izvore informacija o zatvorenim modelima.
  • Za trendove implementacije otvorenih modela koristiti !«メールアドレス» kao stalnu točku praćenja ComfyUI ekosustava.
  • Za Reddit i Bluesky pripremiti prijavljene sesije ili službene API ključeve prije sljedećeg istraživanja; bez drukčijeg pristupa istraživanje neće biti učinkovito.
  • Pinterest nije pogodan za aktualne vijesti; sljedeći put ga koristiti samo za analizu vizualnih trendova.
  • Primjere koji se predstavljaju kao otvorene težine, ali zapravo koriste ograničeni pristup ili hibridne licence (FLUX 3, MiniMax H3), klasificirati tek nakon provjere teksta licence.
  • Redovito provjeravati Lemmy zbog pravnih i kontroverznih vijesti poput povlačenja Sore i Grokovih tužbi, jer ondje često prije X-a izlaze konkretni primjeri.

Prikupljene slike

AI sadržaj i zabrinutosti oko društvenih mreža🎨 AI izrada slika i videaGoogle najavljuje video iznimno visoke kvalitete...Koncept stvaranja AI sadržaja s ikonama za generiranje teksta, slika, glazbe i videa — pregledajte 57 stock fotografija, vektora i videaGoogle predstavlja Veo 2: napredni AI alat za generiranje videa s većim realizmom i filmskim značajkamaSamo to savršeno odradi 🎥slikaAI vijesti: OpenAI je napokon objavio ono što smo tražiliVeo 3 Image-to-Video: brzo generiranje i nativni zvuk putem Gemini API-jaNajbolji AI generatori videa 2025.slika‎🚨 AI postaje zastrašujuće dobar.GPT 5.2, uređivač videa u stvarnom vremenu, AI stereo videozapisi, mobilni AI agenti, puna kontrola tijela: AI VIJESTIViše od 20% YouTubea sada je AI-generiranoAI analiza slika i videaAI za generiranje slika i videaslikaMicrosoft predstavlja VASA-1, postavlja nove standarde za generativni AI u stvaranju videaAI-generirani videozapisi: dobri ili loši? Evo istine! 🤖🎥Ovladavanje videom i AI-jem: ključni trendovi marketinga na društvenim mrežama 2025.Kako AI mijenja uređivanje videaŠto je Imagvio AI i kako pomaže kreatorima...slikaAI alatiShengShu Technology predstavlja Vidu S1, donoseći interaktivnu generaciju AI videa u stvarnom vremenuOvaj tjedan u AI vijestima — 15. kolovoza 2026.Pretvorite svoje ideje u zapanjujuće vizuale! 🎥15 najvećih AI ažuriranja koja trebate znati | Najnovije AI vijesti i trendovipovijest generativnog AI-jaAI vijesti i najnovija ažuriranja | Trendovi i otkrića u umjetnoj inteligenciji"Preobrazite svoju viziju personaliziranim AI videozapisima u 4K 🎥✨"Najveći razvoj AI-ja ovog tjedna — Googleovo istraživanje 15 milijuna chatova„Amuse 3.0”, AI alat za stvaranje umjetnosti koji uključuje...Nvidia #NOVI AI alati 🤯 #vijesti #ai #openai #chatgpt #istaknuto #shortsIzradit ću objašnjenje AI videa uz synthesia sora ai kling ai runway ai invideoAIGoogle najavljuje AI za generiranje videa „Veo 3”,..."Zašto AI chatbotovi ne uspijevaju pratiti najnovije vijesti"Profesionalna AI izrada videa | Filmski AI videozapisi | Prilagođeno uređivanje videa🚀10 najboljih AI alata za slike i video u 2026. | Usporedba besplatnih i plaćenih AI alataAI generiranje slikaGeneriranje videa 📹slikaSlike aktualnih događaja s nacionalnim i svjetskim kartamaKako generirati fotografiju | Kako generirati sliku, Kako generirati fotografije, Generac generator od 22 kWKako izraditi kanal s vijestima uz AI || Generator AI videa s vijestima || AI sinkronizacija usanaPrestanite listati… ova će priča potpuno promijeniti vaš pogled na AI!Rast tržišta AI generatora videa 2025.–2032.: preobrazba budućnosti stvaranja videa 🎥🤖Međusobno povezani ekosustav umjetne inteligencijeslika

Napomena o kvaliteti podataka

Reddit je zbog blokiranog pristupa imao nula objava. Bluesky je zbog blokiranog API-ja za pretragu vratio samo stare objave iz 2024. i 2025. te nijednu o glavnim modelima iz 2026. Pinterest gotovo da nije pružio uvide o otvorenom kodu. Od šest platformi, X, YouTube i Lemmy tri su glavna izvora dokaza.

Galerija