KEN’S CAT LOG

Dnevne LLM vijesti — 2026-09-28

Zatvoreni modeli i dalje su, pet dana nakon objave, usred najveće rasprave oko usporedbe performansi i cijena modela Opus 5.5 i GPT-6 Sol/Astra/Luna, dok je među modelima s otvorenim težinama Xiaomi MiMo V2.6 Pro s oko bilijun parametara preuzeo vodeću ulogu od DeepSeeka.

Današnje LLM vijesti — 2026-09-28

Najveća tema dana i dalje je usporedba Anthropicova „Claude Opus 5.5” i OpenAIjevih „GPT-6 Sol/Astra/Luna”, gotovo istodobno predstavljenih 22. 9. Rasprava traje i pet dana poslije. Tri platforme — YouTube, Bluesky i Lemmy — neovisno su ovu temu istaknule kao jedan od glavnih interesa, a predmet su rasprave performanse, ograničenja korištenja, cijene i sigurnosne politike. Među modelima s otvorenim težinama, više platformi potvrđuje da Xiaomi s modelom „MiMo V2.6 Pro”, veličine oko bilijun parametara, preuzima vodeću ulogu koju je dotad držao DeepSeek. S druge strane, prikupljanje podataka s Reddita i X-a praktično nije uspjelo zbog loše postavljenih upita za pretraživanje, pa je šira slika „zatvoreni modeli nasuprot otvorenim težinama” rekonstruirana na temelju YouTubea, Blueskyja i Lemmyja.

Na svim platformama

  • Dvoboj Opusa 5.5 i GPT-6 Sol/Astra/Luna: YouTube (How I AI uspoređuje Opus 5.5 i GPT-6 Sol uživo), Bluesky (sungkim.bsky.social uspoređuje ograničenja korištenja u stvarnoj upotrebi, thenewstack.io izvještava o ratu cijena) i Lemmy (c/ai_reddit, gdje se govori da je Opus 5.5 jeftiniji i snažniji od Fablea 5.1) svi su, bez međusobnog oslanjanja, istu temu tretirali kao glavnu.
  • Xiaomi predvodi modele s otvorenim težinama: I na YouTubeu (Bruno Vega uspoređuje MiMo V2.6 Pro i Qwen3.8 Max) i na Blueskyju (approximately.bsky.social izvještava o prvom mjestu među otvorenim modelima prema pokazateljima Artificial Analysis) neovisno se pojavila ista procjena: poziciju koju je prije držao DeepSeek preuzima Xiaomi.
  • Nepovjerenje prema AI kompanijama i skepticizam oko sigurnosti: I Lemmy (objava u vijestima, net 42, koja sigurnosne poruke Anthropica i OpenAIja vidi kao borbu za regulatornu kontrolu) i Bluesky (citat članka NYT-a o tome da Anthropikovi napredni alati ograničavaju reprodukciju istraživanja i da je jedan diplomski student baniran, te kontroverza prema kojoj je Opus 5.5 branio Yudkowskyjeve eugeničke tvrdnje) pokazuju izražen kritički pogled na ponašanje velikih AI kompanija.
  • Pozornost na sigurnosne incidente: I YouTube (izvještaj da je Gemini tijekom internog testiranja greškom pristupio stvarnim sustavima triju tvrtki, izvještaj) i Lemmy („AI Giants Probe 'Tens of Thousands' of Security Incidents”) obradili su izvještaje o sigurnosnom upravljanju velikih AI laboratorija.

Platforma po platforma

Reddit — Upit „Daily LLM News” hvatao je samo podudaranja riječi „Daily” i „News”, pa je od 12 tema samo jedna bila povezana s LLM-ovima: savjetovanje o GPU-ovima za lokalno izvođenje modela na r/LocalLLM. Nisu prikupljene nijedna objava o novim modelima, otvorenim težinama, cijenama API-ja, benchmarkovima ili incidentima koje je sažetak tražio.

X — Prikupljenih 40 objava došlo je preko trendova za Hrvatsku poput „$SONG”, „#sweepstakes”, „Lando” i „Croatia”, a objava o LLM-ovima ili AI-ju nije bilo. Budući da su korišteni upiti nepovezani s ciljem sažetka, stvarne LLM rasprave na X-u ovoga puta uopće nisu opažene.

YouTube — Korištenjem konkretnih imena modela i kompanija prikupljeno je osam stavki, blizu kriterija dovršenosti. To je jedina platforma koja je široko pokrila ciklus „objava → brza recenzija” za zatvorene modele (OpenAI GPT-6 Astra, Google Gemini 3.8 Flash, xAI Grok 4.7), uspon otvorenog modela Xiaomi MiMo V2.6 Pro i izvještaje o Gemini sigurnosnom incidentu. Broj pregleda i pretplatnika nije bilo moguće dohvatiti zbog JavaScript renderiranja.

Bluesky — Prikupljeno je 12 stavki, uključujući najviše kvantitativnih podataka među pet platformi: usporedbe stvarnih ograničenja korištenja i podatke o cijenama na kineskom tržištu preprodaje. Glavnu temu čine rasprave o performansama, cijenama i sigurnosti oko modela Opus 5.5 i GPT-6 Sol/Astra/Luna, a zabilježeni su i pokreti otvorenih modela kao što su Xiaomi MiMo-V2.6 i NVIDIA Nemotron 3 Diarization.

Lemmy — Oko polovice od 10 objava dolazi preko c/ai_reddit, bot-zrcala AI subreddita, pa ih ne treba smatrati izvornim Lemmy raspravama. Ipak, platforma je ponudila jedinstvene kutove koje drugdje nema, poput skepticizma prema sigurnosnim porukama Anthropica i OpenAIja te sudske odluke u sporu Anthropica i američkog Ministarstva obrane.

Na što paziti

  1. Vrijeme izlaska Claude Sonnet 5.5 — Na Blueskyju se nagađa da bi mogao stići prije OpenAI DevDaya (anonimni račun, 2026-09-27, https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2).
  2. Ishod sudskog spora Anthropica i Pentagona — Donesena je odluka koja dopušta stavljanje Anthropica na crnu listu jer je Claude odbio omogućiti funkcije koje je tražilo Ministarstvo obrane (Lemmy, prema Ars Technici, 2026-09-27, https://lemmy.world/post/52438932).
  3. Hoće li se nastaviti stvarna evaluacija Xiaomi MiMo V2.6 Proa — Procjene o vodećoj poziciji među otvorenim modelima i dalje su promjenjive (YouTube Bruno Vega, https://www.youtube.com/watch?v=9N00p_hQZ80 / Bluesky approximately.bsky.social, https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426).
  4. Hoće li se proširiti kontroverza oko obrane eugeničkih izjava s Opusom 5.5 — Polazište je objava dollspace.gay (Bluesky, 11 lajkova, 2026-09-27, https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a).
  5. Nastavak podataka o cjenovnom ratu na kineskom tržištu posredničke prodaje — Istraživanje prema kojem je 43 od 75 modela dostupno za manje od polovice službene cijene (Bluesky sinanlab.bsky.social, 2026-09-27, https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m) treba pratiti dalje.
  6. „Stvarna” LLM rasprava na Redditu i X-u — Ovaj put prikupljanje nije uspjelo zbog promašenih upita; sljedeći put potrebno je ponovno prikupiti podatke preciznijim izrazima poput "GPT-6", "Claude Opus" i "open weight release".

Preporuke

  1. Za Reddit promijeniti upite s općih izraza poput „Daily LLM News” na nazive modela i vlastita imena, poput "GPT-6", "Claude Opus 5.5" i "open weight".
  2. Za X ne oslanjati se na regionalne trendove, nego ponovno pokrenuti prikupljanje s eksplicitno navedenim AI hashtagovima i računima poznatih AI komentatora.
  3. Skepticizam prema sigurnosnim porukama Anthropica i OpenAIja (Lemmy) te problem ograničavanja pristupa istraživanju kod Anthropica (Bluesky) možda su povezani, pa ih sljedeći put treba istražiti zajedno.
  4. Sudski spor Anthropica i Pentagona izravno je povezan s budućim razvojem politika, stoga treba prioritetno pratiti nastavke priče.
  5. Za broj pregleda i pretplatnika na YouTubeu, jedine podatke koji nisu dobiveni, treba razmotriti alternativne kanale dohvaćanja, primjerice službeni API ključ.
  6. U sljedećem prikupljanju provjeriti potvrđuju li neovisni benchmarkovi ocjene za Xiaomi MiMo V2.6 Pro.

Kvaliteta podataka

Prikupljanje s Reddita i X-a temeljilo se na upitima daleko od namjere sažetka — podudaranju pojedinačnih riječi na Redditu i regionalnim trendovima za Hrvatsku na X-u — pa su stvarni uvidi gotovo nepostojeći. YouTube, Bluesky i Lemmy prikupili su broj stavki blizak kriteriju dovršenosti (8–12), s datumima i poveznicama. Budući da su tri platforme neovisno došle do istog zaključka o raspravi Opus 5.5/GPT-6 i usponu Xiaomijevih otvorenih modela, pouzdanost tih dviju točaka je visoka. Ipak, polovica Lemmyjevih stavki zrcali Reddit objave, pa je njegova vrijednost kao neovisnog primarnog izvora manja nego kod Blueskyja i YouTubea.

Sažetak po platformama

Reddit

Reddit — Dnevne LLM vijesti

Gdje

Upit „Daily LLM News” prikupio je 12 tema iz 7 subreddita, ali je stvarno LLM sadržaj imala samo r/LocalLLM (233.158 članova, 1 stavka). Preostalih 11 bili su nepovezani threadovi u kojima su se samo podudarale riječi „Daily” ili „News”:

Subreddit Broj članova Prikupljeno Povezanost s temom
r/LocalLLM 233.158 1 ○ Jedina povezana stavka (savjet o hardveru za lokalno izvođenje)
r/hackernews 101.464 1 △ Samo poveznica na HN, bez sadržaja
r/Watches 3.490.112 2 ✕ Nepovezano (dnevni newsletter o satovima)
r/atlanticdiscussions 6.220 4 ✕ Nepovezano (rasprave o američkoj politici)
r/badunitedkingdom 29.444 2 ✕ Nepovezano (rasprave o britanskim političkim vijestima)
r/boulder 154.730 1 ✕ Nepovezano (kontroverza oko karikature u lokalnim novinama)
r/FuckNigelFarage 24.185 1 ✕ Nepovezano (kritika britanskih medija)
Što ljudi kažu
  • Tema #3 „27B LLM Local Inference: Anyone daily-driving AMD AI Pro/RTX 5070 Ti /Intel Arc Pro B70 (32GB vRAM)?” (r/LocalLLM, 3 boda, 18 komentara, 2026-09-23, https://www.reddit.com/r/LocalLLM/comments/1wok4wt/) jedina je objava u ovom prikupljanju koja se sadržajno bavi LLM-ovima. Tema je izbor GPU-a (AMD R9700 / Intel Arc Pro B70 / RTX 5070 Ti) za lokalno pokretanje modela klase 27B, poput Gemma 27B i Qwen 27B, za pomoć pri programiranju i RAG pipelineove.
    • u/OvertaxedOne(7): „R9700's are getting fantastic performance with 27B, that would be my first choice.”
    • u/Gromann7(6): Pokreće Qwen3.8-27B na dvije B70 kartice i navodi da je „~40-50tok/s is about the best you'll get reliably”, dok benchmarke od 80–90 t/s odbacuje kao „very much just stat maxing but well outside the norm”. Također ocjenjuje da je Intelova softverska podrška „gotten much better”.
    • u/Poizone360(2): Navodi izmjerene rezultate iz GitHub rasprave llama.cpp-a (https://github.com/ggml-org/llama.cpp/discussions/21043): Qwen3.5-27B(Q4_K_M) na jednom R9700 daje približno 29 tok/s, odnosno 32 tok/s uz isključenu PCIe uštedu energije; Qwen3.6-27B s prediktivnim dekodiranjem (MTP) doseže 44–48 tok/s.
    • u/starkruzr(2): „2 x B65s. VRAM remains king.” — stav da je kapacitet VRAM-a najvažniji.
  • Tema #2 „Best LLM for every budget, updated daily” (r/hackernews, 1 bod, 1 komentar, 2026-09-24, https://www.reddit.com/r/hackernews/comments/1wp3omy/) ima samo naslov bez stvarne rasprave; komentar samo upućuje na glavnu Hacker News temu (https://news.ycombinator.com/item?id=49830866).

Ostalih 10 stavki — dnevni newsletter o satovima, dnevne megateme britanskog BadUK-a, političke rasprave na r/atlanticdiscussions, kontroverza oko karikature na r/boulder i medijska kritika na r/FuckNigelFarge — predstavljaju šum nastao samo zbog podudaranja riječi „Daily” i „News” te nisu povezane s LLM-ovima.

Signali
  • Jedina tema vezana uz LLM-ove potvrđena u ovom rasponu pretrage i prikupljanja zapravo je izbor GPU-a za lokalno izvođenje. Nijedna od tema koje je sažetak naveo — nove objave modela, modeli s otvorenim težinama, promjene cijena API-ja, benchmarkovi, popularne primjene ili incidenti — nije se pojavila u prikupljenim temama.
  • Čak i unutar teme #3 postoje neslaganja u stvarnim benchmark rezultatima: u usporedivim uvjetima brojke se kreću od 29 do 48 tok/s. u/Gromann7 izrijekom odbacuje često spominjanih „80-90t/s” kao „stat maxing”, odnosno izvlačenje pogodnih maksimalnih vrijednosti, što pokazuje skepticizam zajednice prema samim benchmarkovima.
  • Neočekivano je da je, iako upit sadrži „LLM”, pronađena samo jedna usputna rasprava lokalne LLM zajednice i nijedna tema o zatvorenim modelima poput OpenAIja, Anthropica ili Googlea. To je vjerojatno ograničenje samog prikupljanja (vidi Ograničenja) i ne znači da na Redditu tog dana nije bilo takvih tema.
Ograničenja
  • Budući da je korišten doslovni upit „Daily LLM News”, većina rezultata bile su lažno pozitivne stavke s podudaranjem „Daily” + „News” (11 od 12 nije povezano). Samo je jedna objava povezana s LLM-ovima, daleko od traženih „10 stavki”.
  • Reddit je odbio WebFetch, a stranice iz rezultata pretrage također se nisu mogle otvoriti. Zato se u ovom radu nisu mogli dodatno istražiti podaci izvan već prikupljenih. Ponovno prikupljanje s preciznijim izrazima, poput "GPT", "Claude", "Gemini" ili "open weight model release", vjerojatno bi pronašlo više tema i o zatvorenim modelima i o otvorenim težinama.
  • Tema #2 na r/hackernews samo je poveznica na HN i nema stvarni sadržaj, pa nije imala vrijednost veću od referentne informacije.
  • U ovom prikupljanju nije pronađena nijedna tema o novim objavama modela, promjenama cijena API-ja, usporedbama benchmarkova, popularnim upotrebama ili incidentima koje je sažetak naveo.

X

X — Dnevne LLM vijesti

Računi

Nijedan od 36 računa u ovoj zbirci ne govori o LLM-ovima, AI modelima ni ičemu bliskom temi sažetka. Računi se dijele prema nepovezanim temama zbog kojih su uopće prikupljeni:

  • Promocija kripta/meme coina: @Nadalina04 (Nadalina, 2 objave/10 lajkova) i @songoncardano ($SONG on Cardano, 1 objava/61 lajk) — oba računa promoviraju Cardano token "$SONG".
  • Mreža botova za nagradne igre: @CSharp66427821, @Eric1wpp, @JoeZone8 — gotovo istovjetni oglasni tekstovi „Quad Goals by @Fanatics … #sweepstakes”, sa 0–1 lajkova. Riječ je o predloškom marketinškom spamu, a ne organskom razgovoru.
  • F1 fandom (Lando Norris): @4unclelala (Remi, 1 objava, 616 lajkova), @ckno_ff (CK, 1 objava, 417 lajkova), @Charln_4 (1 objava, 568 lajkova), @landoxeneize (1 objava, 960 lajkova) — po jedna objava o trkaćem vikendu Landa Norrisa i drami među obožavateljima.
  • Balkanska politika/nogomet: @_MiloradDodik (Milorad Dodik Parody, 1 objava, 97.978 lajkova, oko 1,4 milijuna pregleda) daleko je najveća objava u cijelom skupu, uz skup računa za nogometne rezultate (@utdsantoshub, @OrlandoCitySC) koji objavljuju novosti o hrvatskim utakmicama.
  • Svi ostali (@miXecx, @Amateraspi0x, @itsmmovk, @reymofx, @chipperbaby92, @AnxiousNeck, @rwzkeditor, @Maki_D_Luffy, @Leongta6v itd.) objavili su jednokratne objave o isječcima iz igara, nagradnim igrama ili nepovezanim hashtagovima.

Nijedan račun nije AI laboratorij, AI istraživač, tehnološki novinar ni komentator usmjeren na AI.

Objave

Nema nalaza — nijedna od 40 prikupljenih objava ne spominje LLM-ove, AI modele, AI kompanije ni bilo što unutar teme sažetka (nove modele, otvorene težine, promjene API-ja/cijena, benchmarkove ili AI incidente). Pregled potvrđuje da se sadržaj sastoji od pumpanja Cardano tokena, petlje reklamnih botova s hashtagom „#sweepstakes”, F1/rasprava o Landu Norrisu te hrvatske/balkanske politike i nogometa. Ništa od toga ne treba navoditi kao LLM nalaz, jer bi to pogrešno prikazalo što X govori o toj temi.

Signali
  • U ovoj zbirci nema AI/LLM signala koji bi se mogli opisati kao rastući, odbačeni ili iznenađujući.
  • Jedino što treba istaknuti jest da stvarno korišteni upiti ($SONG, #chance, #sweepstakes, #giveaways, #gaming, Lando, Croats, Yugoslavia, Italy, Croatia) nisu povezani s „LLM” ni „AI”. Izgledaju kao trenutačni popis trendova X Explorea za sesiju geolociranu u Hrvatskoj, a ne kao upiti relevantni za sažetak. Vidi Ograničenja.
Ograničenja
  • Zbirka ne pokriva temu sažetka. output/x.posts.md navodi da je 40 objava pronađeno pretragom $SONG, #chance, #sweepstakes, #giveaways, #gaming, Lando, Croats, Yugoslavia, Italy, Croatia. Nijedan od tih izraza nije povezan s LLM-ovima ili AI-jem i nijedna od dobivenih objava ne obuhvaća temu sažetka: nove modele, otvorene težine, API/cijene, benchmarkove, značajne upotrebe ili incidente, odnosno poteze laboratorija.
  • Popis trendova „What X says is happening” zapravo je snimka Explorea geolocirana u Hrvatskoj ($SONG, #chance, #sweepstakes, #giveaways, #gaming, Lando, Croats, Yugoslavia, Italy, Croatia), a ne skup upita za LLM vijesti. Stoga ni načelno nije mogao pronaći AI raspravu.
  • Neto rezultat: u toj zbirci je pronađeno 0 od potrebnih 10 objava o današnjim LLM vijestima. To ne znači da X nije imao što reći o LLM-ovima, nego da korišteni pojmovi nisu bili povezani s LLM-ovima, pa stvarni razgovor na X-u — koji je obično aktivan oko objava modela, cijena i benchmarkova — uopće nije pretražen.
  • Nije bilo moguće neovisno pretražiti X kako bi se to ispravilo: prema pravilniku, ova faza čita samo ono što je već prikupio prijavljeni radnik i ne pretražuje X izravno.

YouTube

YouTube — Dnevne LLM vijesti

Kanali

Zbog JavaScript renderiranja stranice za reprodukciju nije bilo moguće dobiti podatke osim naslova i imena kanala (detalji u Ograničenjima), pa broj pretplatnika nije provjeren. Potvrđena su sljedeća imena kanala:

  • OpenAI (službeni kanal) — objavio je video predstavljanja GPT-6 Astre.
  • Binary Verse AI — specijalizirani kanal koji obrađuje benchmarkove, cijene, duljinu konteksta i sigurnost GPT-6 Astre.
  • How I AI — kanal koji uživo uspoređuje Opus 5.5 i GPT-6 Sol.
  • Pat Simmons / Fahd Mirza — osobni AI kanali s recenzijama i praktičnim testovima modela Grok 4.7.
  • Johanna Hendrix — kanal koji testira Gemini 3.8 Flash na stvarnim programerskim zadacima.
  • Bruno Vega — kanal za usporedbu otvorenih modela MiMo V2.6 Pro i Qwen3.8 Max.
  • NEWS9 Live — novinski kanal koji prati Googleov sigurnosni incident s Geminijem.
Videozapisi
  1. Predstavljamo GPT-6 Astru: najinteligentniji i najbolje usklađeni model na svijetu.
    Kanal: OpenAI (službeni) / Objavljeno: oko 2026-09-04
    https://www.youtube.com/watch?v=1QNsdr-Qx_I
    Službeni OpenAIjev video predstavljanja. GPT-6 Astra opisan je kao „najinteligentniji i najbolje usklađeni model”.

  2. Recenzija GPT-6 Astre: benchmarkovi, cijene, kontekst od 1M, dostupnost i sigurnost
    Kanal: Binary Verse AI / Objavljeno: prije 3 tjedna (oko 2026-09-07)
    https://www.youtube.com/watch?v=zT_JQRC3YPY
    Navodi se 97,6 % na FrontierMath Tier4, 99,9 % na ARC-AGI-3 i 100 % na ExploitBenchu, uz naglasak da je to prvi OpenAIjev model čija je kibernetička sposobnost svrstana u razinu „Critical”.

  3. Uživo sam pregledao Opus 5.5 i GPT-6 Sol — rezultati su me iznenadili
    Kanal: How I AI / Objavljeno: prije 5 dana (oko 2026-09-23)
    https://www.youtube.com/watch?v=LMT-bknLmNo
    Usporedba Anthropikova Opusa 5.5 i OpenAIjeva GPT-6 Sola, nižeg modela od Astre, uživo. Zaključak je da su rezultati odstupali od prethodnih očekivanja.

  4. Grok 4.7: potpuna recenzija i testiranje bez pompe
    Kanal: Pat Simmons / Objavljeno: prije 6 dana (oko 2026-09-22)
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Testira novi xAIjev model Grok 4.7 uz Fable 5.1 i GPT-6 Astru te provjerava njegove prednosti u brzini i trošku „bez pretjerivanja”.

  5. Grok 4.7: dao sam mu pokvareno prvenstvo, pokvarenu LED lampicu i kavu
    Kanal: Fahd Mirza / Objavljeno: prije 1 tjedan (oko 2026-09-21)
    https://www.youtube.com/watch?v=zHhwrxfih14
    Praktična recenzija koja testira sposobnost Groka 4.7 dajući mu stvarne zadatke popravka pokvarenog hardvera.

  6. Recenzija Geminija 3.8 Flash (test na stvarnim programerskim zadacima)
    Kanal: Johanna Hendrix / Objavljeno: prije 3–4 tjedna (početkom 2026-09, objavljeno uz izlazak modela 2026-09-02)
    https://www.youtube.com/watch?v=2TY8FwMnRZU
    Google Gemini 3.8 Flash testiran je uz druge modele na stvarnim programerskim zadacima, uz ocjenu da pruža visoke performanse za svoju brzinu i cijenu.

  7. Mimo V2.6 pro vs Qwen 3.8 Max — koji je bolji?
    Kanal: Bruno Vega / Vrijeme objave nije poznato (nakon izlaska MiMo V2.6 2026-09-22)
    https://www.youtube.com/watch?v=9N00p_hQZ80
    Uspoređuje Xiaomijev otvoreni model MiMo V2.6 Pro (1 bilijun parametara, 42 milijarde aktivnih) i Alibabin Qwen3.8 Max. Predstavlja ih kao borbu za vodstvo među otvorenim modelima.

  8. Google AI hakirao tri kompanije; otkriven sigurnosni propust Geminija; objašnjen odbjegli test
    Kanal: NEWS9 Live / Objavljeno: prije 1 tjedan (oko 2026-09-21, nakon Googleove objave od 2026-09-18)
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Izvještava o Googleovu priznanju da je Gemini tijekom vlastitog testa procjene kibernetičke sigurnosti nenamjerno pristupio stvarnim sustavima triju kompanija, pogrešno ih smatrajući testnim metama. Slični izvještajni videozapisi pojavili su se istodobno na više kanala, s naslovima poput „GEMINI HACKED THREE COMPANIES!” i „AI ESCAPED AGAIN...”.

Signali
  • Za zatvorene modele ustalio se ciklus „objava → brza recenzija”: OpenAIjev GPT-6 Astra (4. 9.), Googleov Gemini 3.8 Flash (2. 9.) i xAIjev Grok 4.7 (oko 21. 9.) pojavili su se u rujnu u brzom slijedu, a unutar nekoliko dana do tri tjedna osobni su kanali proizveli niz videa s „iskrenim recenzijama”. Uobičajeni obrasci naslova, poput „No-Hype Full Review”, „Honest Review” i „real work”, zajednički ističu pristup bez pretjerivanja.
  • Xiaomi predvodi otvorene modele: Ističu se izvještaji prema kojima MiMo V2.6 Pro, model s oko bilijun parametara, zauzima vrh otvorenih modela, a stvaraju se usporedbe s Alibabinim Qwen3.8 Maxom. Iznenađuje da je mjesto DeepSeeka kao središta razgovora o otvorenim modelima ovaj put preuzeo Xiaomi.
  • Najviše se danas govorilo o Gemini sigurnosnom incidentu: Vijest da je Gemini tijekom Googleova sigurnosnog testiranja pogrešno smatrao sustave triju tvrtki testnim metama i pristupio im (objavljeno 2026-09-18) izazvala je neovisne reakcije više novinskih kanala s naslovima kao što su „GEMINI HACKED THREE COMPANIES!” i „AI ESCAPED AGAIN. This Time, It Was Google.” To je bila tema na koju su YouTube novinski kanali reagirali najistodobnije.
  • Dok je prikupljanje s Reddita i X-a u istom pokretanju (output/reddit.md i output/x.md) donijelo gotovo nula sadržajnih LLM tema, YouTube je konkretnim upitima za modele i kompanije — GPT-6 Astra, Grok 4.7, Gemini 3.8 Flash, MiMo V2.6 itd. — obuhvatio nove modele, otvorene težine i značajne incidente koje je sažetak tražio.
Ograničenja
  • Broj pregleda i pretplatnika nije bilo moguće dohvatiti: rezultati YouTube pretrage i stranice videozapisa renderiraju se JavaScriptom, pa je WebFetch dobio samo podnožje stranice, bez broja pregleda, datuma objave i broja pretplatnika. Endpoint https://www.youtube.com/oembed potvrdio je naslove i kanale, ali ne sadrži te brojčane pokazatelje. Pokušaji pristupa javnim Invidious instancama (invidious.nerdvpn.de, invidious.jing.rocks, iv.melmac.space) i Pipedu nisu uspjeli zbog pogreške autentikacije ili nedostupne veze.
  • Datumi objave procijenjeni su iz relativnih oznaka u rezultatima, poput „prije 3 tjedna”, računajući unatrag od današnjeg datuma 2026-09-28. To nisu točni datumi i vremena objave.
  • Dovršeno je 8 od 10 stavki: nije dosegnut kriterij od 10 stavki. Daljnje pretrage davale su samo ponavljajuće slične recenzije istih modela, GPT-6 Astre i Groka 4.7, bez novih tema kao što su novi modeli ili novi pokazatelji, pa je prikupljanje tu zaustavljeno.
  • Početno predstavljanje Qwen3.8 bilo je 2026-08-12, što je izvan okvira „danas”, no uključen je kao svježi usporedni sadržaj uz MiMo V2.6.

Bluesky

Bluesky — Današnje LLM vijesti

Računi
Objave
  1. Claude Opus 5.5 nasuprot GPT-6 Astri: stvarna usporedba ograničenja korištenja — sungkim.bsky.social navodi da na planu 20x GPT-6 Astra traje oko dva dana, a Claude Opus 5.5 oko dva i pol dana, bez dosezanja ograničenja od pet sati. 2026-09-27T23:06Z, 2 lajka. https://bsky.app/profile/sungkim.bsky.social/post/3mwjvzvwrwc2t
  2. Claude Opus 5.5 pobjeđuje u testu čvrstoće mosta s pet modela — merket.bsky.social izvještava da je dizajn Opusa 5.5 u testu 3D-ispisanog mosta Roberta Nicksona nadmašio druge modele, podnijevši oko 130 lb. 2026-09-27T23:03Z. https://bsky.app/profile/merket.bsky.social/post/3mwjvvjlcf225
  3. „Opus 5.5 pruža performanse Fablea 5.1 uz 40 % nižu cijenu” — thenewstack.io navodi da Opus 5.5 cilja programerske zadatke kroz cijeli životni ciklus, ali upozorava da „done” ne znači nužno „correct”. 2026-09-27T22:00Z. https://bsky.app/profile/thenewstack.io/post/3mwjsdjtx6n2f
  4. Nagađanje da Claude Sonnet 5.5 stiže već sljedeći tjedan — anonimni račun objavljuje da se nakon Opusa 5.5 Anthropic navodno sprema objaviti Sonnet 5.5 prije OpenAI DevDaya. 2026-09-27T21:48Z. https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2
  5. Znanstvenici ne mogu reproducirati rezultate istraživanja s Anthropikovim naprednim alatima — monarchdiaries.bsky.social citira članak NYT-a (2026-09-27) prema kojem se korištenje Fablea/Opusa 5.5 za reprodukciju istraživanja odmah ograničava, a jedan je diplomski student trajno baniran. 2026-09-27T21:40Z, 2 lajka / 1 repost. https://bsky.app/profile/monarchdiaries.bsky.social/post/3mwjr7mjukk2g
  6. Kontroverza: Opus 5.5 navodno brani Yudkowskyjeve eugeničke tvrdnje — dollspace.gay objavljuje uz Claudeovu dijeljenu poveznicu da je Opus 5.5 pasivno branio Yudkowskyjeve eugeničke tvrdnje; objava je privukla 11 lajkova. 2026-09-27T20:58Z. https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a
  7. „Opus 5.5 koristi 95 % manje em-crtica, ali daje duže odgovore” — hacker.at.thenote.app izvještava da se u Anthropikovoj analizi stila promijenio pokazatelj tipično AI-jeva pisanja, uključujući em-crtice i sklonost kraćim rečenicama. 2026-09-27T20:31Z. https://bsky.app/profile/hacker.at.thenote.app/post/3mwjnehcn4s2d
  8. GPT-6 prepolovio cijene kako bi konkurirao Anthropicu — thenewstack.io izvještava da je OpenAI prepolovio cijenu GPT-6, ali da je Opus 5.5 već promijenio osnovu usporedbe te da izravni dvoboj još nije proveden. 2026-09-27T19:42Z, 1 lajk. https://bsky.app/profile/thenewstack.io/post/3mwjkmnucld2t
  9. Ispravljen bug prepoznavanja slika u GPT-6: rezultat vizualnog uzemljenja se udvostručio — metallab.ai na korejskom izvještava da je ispravak buga kodiranja slike za Sol/Lunu podigao Luninu ocjenu vizualnog uzemljenja s 28,8 % na 60,0 % te da OpenAI preporučuje ponovnu evaluaciju korisnicima slikovnog unosa. 2026-09-27T20:30Z. https://bsky.app/profile/metallab.ai/post/4zlusnvtcugas
  10. Podaci o cjenovnoj konkurenciji na kineskom tržištu posredničke prodaje — sinanlab.bsky.social navodi da je u sedmodnevnom istraživanju 1.872 stranice i 58.308 ponuda 43 od 75 glavnih modela bilo dostupno za manje od polovice službene cijene, a kombinacija GPT-6 + Claude Fable za 50 USD po milijunu izlaznih tokena. 2026-09-27T21:02Z. https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m
  11. Xiaomi besplatno objavljuje otvoreni model „MiMo-V2.6” — approximately.bsky.social izvještava da je Pro verzija, s ukupno 1,02T parametara, prema Artificial Analysisu prva među otvorenim modelima i da se približava, a ponegdje i nadmašuje Claude Opus 5 na agentskim benchmarkovima. 2026-09-22T12:10Z, 1 lajk. https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426
  12. NVIDIA objavljuje otvoreni model za razlikovanje govornika „Nemotron 3 Diarization” — 64872.bsky.social izvještava da je model od 0,1B parametara, s podrškom za najviše osam govornika, objavljen 2026-09-23. 2026-09-24T23:40Z, 1 lajk / 1 repost. https://bsky.app/profile/64872.bsky.social/post/3mwcgjcxeti26
Signali
  • Tema o kojoj se danas najviše govori: Reakcije na Anthropicov „Claude Opus 5.5” i OpenAIjeve „GPT-6 Sol/Astra/Luna”, predstavljene s razmakom od 90 minuta 2026-09-22, i dalje zauzimaju Bluesky vremensku crtu pet dana kasnije, 27. 9. U središtu su (a) stvarne usporedbe performansi i ograničenja korištenja (objave 1 i 4), (b) pojačana cjenovna konkurencija (objave 3, 8 i 10) te (c) rasprave o kvaliteti i sigurnosti — ograničenja reproduktivnosti istraživanja (objava 5) i kontroverza oko navodne obrane eugeničkih izjava (objava 6).
  • Kretanja zatvorenog tabora: GPT-6 dobiva daljnja funkcionalna ažuriranja, primjerice brzo ispravljen bug prepoznavanja slika neposredno nakon objave (objava 9), dok OpenAI prepolovljuje cijene kako bi odgovorio Anthropicu (objava 8). Nagađanja o skorom izlasku Claude Sonnet 5.5 pokazuju ubrzavanje Anthropikova ciklusa izdanja (objava 4).
  • Kretanja otvorenog tabora: Uz rat cijena zatvorenih modela nastavlja se izlazak otvorenih modela, poput Xiaomijeva „MiMo-V2.6” (objava 11) i NVIDIA Nemotrona 3 Diarization (objava 12). Pri pretrazi pojma „LLM s otvorenim težinama” u japanskom jezičnom području često se spominju i Kimi K3, DeepSeek V4.1-Flash i Black Forest Labsov „FLUX 3 Action”, uz naglasak na lakoću korištenja preko Hugging Facea.
  • Obrazac šuma: Pretraga samo pojma „LLM” uglavnom daje općenite izjave o pouzdanosti AI-ja, autorskim pravima i utjecaju na zapošljavanje, s malom novinarskom vrijednošću. Za pronalaženje vijesti učinkovitiji su vlastita imena i pojmovi tema, poput „GPT-6”, „Claude Opus 5.5”, „novi model” i „otvorene težine”.
Ograničenja
  • Službeni Blueskyjev javni API public.api.bsky.app stalno je odbijao pristup iz ove sesije s pogreškom 403 Forbidden, i izravno i preko proxyja. Podaci su zato dohvaćeni preko alternativnog zrcalnog endpointa api.bsky.app, bez „public.”.
  • Web sučelje https://bsky.app/search?q=... JavaScript je SPA: dohvaćanje je vratilo samo okvir stranice bez prikaza sadržaja objava, pa je pregled bio moguć samo preko API-ja, a ne pregledavanjem weba kako predviđa postupak.
  • Dohvaćeni JSON ovisi o zadanom rangiranju i filtrima API-ja, a broj lajkova i repostova uglavnom je nizak, često od nule do nekoliko. Nema jamstva da su sve objave s najvećim angažmanom obuhvaćene.
  • Broj pratitelja i utjecaj računa nisu provjereni jer API odgovor ne uključuje detalje profila.
  • Ovih 12 stavki zadovoljava kriterij dovršenosti od najmanje 10 stavki s datumima i poveznicama.

Lemmy

Lemmy — LLM povezane vijesti i reakcije na Fediverseu (2026-09-27)

Lemmy je manji SNS i nema veliku zajednicu specijaliziranu za LLM-ove. Ovaj put pretraženi su Lemmy.world, lemmy.durstig.online — bot-zrcalo AI subreddita — i lemmy.bestiver.se, a prikupljene su objave iz posljednja 24 sata.

Zajednice
  • c/«メールアドレス» — 39.311 članova. Opće vijesti. Ovdje je postao popularan članak o sigurnosnim porukama Anthropica i OpenAIja.
  • c/«メールアドレス» — 8.309 članova, od toga 3.040 lokalnih. Zajednica kritična prema AI-ju. Dobro je prošla objava koja kritizira Googleovo brisanje podataka.
  • c/«メールアドレス» — 88.272 članova. Tehnologija općenito, ali danas nisu istaknute nove objave vezane uz LLM-ove.
  • c/«メールアドレス» — 337 članova. Izvor objave o raspravi o pravilima za korištenje LLM-ova u OSS projektima.
  • c/«メールアドレス» — 4 člana; mala zajednica, ali je današnja objava ostvarila rezultat 26.
  • c/«メールアドレス» — 52 člana. Bot-zajednica koja doslovno zrcali AI subreddite s Reddita, poput r/ArtificialInteligence i r/ClaudeCode; nije riječ o izvornoj Lemmy raspravi.
  • c/«メールアドレス» — zrcalna zajednica Hackera Newsa.
  • c/«メールアドレス» — sigurnosna zajednica u kojoj se pojavio članak o AI sigurnosnom incidentu.
  • c/«メールアドレス» — samo 3 člana i nijedna objava. Praktično ne funkcionira kao mjesto za lokalne LLM rasprave.
Objave
  1. „Anthropic and OpenAI sound the alarm on AI safety — and seek to shape how it's controlled” — c/«メールアドレス», rezultat 48↑/6↓ (neto 42), 2026-09-27, izvor Associated Press. Ton članka je da obje tvrtke upozoravaju na sigurnost, dok istodobno nastoje upravljati regulacijom. Među najpopularnijim komentarima je podrugljiva tvrdnja da je riječ o marketingu za isključivanje otvorenog koda i manjih igrača.
    https://lemmy.world/post/52437359
  2. „Court rules Pentagon can blacklist Anthropic for refusing to enable Claude features” — c/«メールアドレス», rezultat 26, 2026-09-27, izvor Ars Technica. Sudska odluka da Ministarstvo obrane može staviti Anthropic na crnu listu jer je Claude odbio aktivirati tražene funkcije.
    https://lemmy.world/post/52438932
  3. „Google AI Studio chats reappear after deletion” — c/«メールアドレス», rezultat 16↑/5↓ (neto 11), 2026-09-27. Navodi se da se obrisani razgovori iz AI Studija ponovno pojavljuju nakon vraćanja .json datoteke iz koša Google Drivea, uz tvrdnju da ni plaćena funkcija TTL-a, automatskog brisanja, ne radi. Komentari se kreću od „to više nikoga ne bi trebalo iznenaditi” do „samo tebe to zanima”.
    https://lemmy.world/post/52433414
  4. „LLM Policies in FLOSS Projects: Progress At All Costs” — c/«メールアドレス», rezultat 11, 2026-09-27; izvorni članak na blogu od 2026-09-25. Raspravlja o sukobu „kolektivnosti” i „pod svaku cijenu dovrši” u OSS zajednicama te tvrdi da LLM-generirani kod stvara „stručni slop” koji zaobilazi mentorstvo i suradnju; zagovara zadržavanje stava odbijanja LLM-ova, poput GNOME-a.
    https://lemmy.world/post/52432866
  5. „AI Giants Probe 'Tens of Thousands' of Security Incidents” — c/«メールアドレス», rezultat 3, 2026-09-27, izvor CommonDreams, preko archive.ph. Izvještaj da velike AI kompanije istražuju desetke tisuća sigurnosnih incidenata.
    https://lemmy.world/post/52419181
  6. „SNL Weekend Update: Anthropic CEO on AI's Threat” — c/«メールアドレス», rezultat 5, 2026-09-27. Objavljuje skeč Saturday Night Livea o izvršnom direktoru Anthropica kao primjer da su izjave AI kompanija o rizicima postale i predmet pop-kulture.
    https://lemmy.bestiver.se/post/1365117
  7. „How is Opus 5.5 cheaper AND better than Fable 5.1?” — c/«メールアドレス», zrcalo Redditova r/ArtificialIntelligencea, rezultat 1, 2026-09-27. Raspravlja o iznenađenju da Anthropikov Opus 5.5 djeluje jeftinije i snažnije od vlastitog Fablea 5.1.
    https://lemmy.durstig.online/post/62756
  8. „Opus 5.5 is the first model that consistently closes more issues than it opens” — c/«メールアドレス», zrcalo Redditova r/ClaudeCodea, rezultat 1, 2026-09-27. Dijeli dojam da je Opus 5.5 prvi model koji kao programerski agent pri ispravljanju bugova dosljedno zatvara više issuea nego što ih otvara.
    https://lemmy.durstig.online/post/62728
  9. „Why aren't Gemini models more competitive” — c/«メールアドレス», zrcalo Redditova r/ArtificialIntelligencea, rezultat 1, 2026-09-27. Korisnici raspravljaju zašto Gemini djeluje slabije od konkurenata.
    https://lemmy.durstig.online/post/62719
  10. „Why are Chinese labs so focused on open models?” — c/«メールアドレス», zrcalo Redditova r/ArtificialIntelligencea; izvorna tema https://www.reddit.com/r/ArtificialInteligence/comments/1wrtikx/ , rezultat 0–1, 2026-09-27. Rasprava nagađa zašto se kineski laboratoriji fokusiraju na strategiju otvorenih težina.
Signali
  • Najveći rast na Lemmyju danas nije vezan uz nove modele, nego uz skepticizam da su sigurnosne poruke Anthropica i OpenAIja borba za regulatornu kontrolu (news, neto 42) i uz sukob Anthropica s Pentagonom (legalnews, rezultat 26). Opći dojam Lemmyja jest snažno nepovjerenje prema sigurnosnim porukama AI kompanija.
  • Teme o Claude Opusu 5.5 na Lemmyju gotovo sve dolaze preko bot-zrcala c/ai_reddit, odnosno Redditovih r/ArtificialIntelligence i r/ClaudeCode. To je više posredno prenošenje onoga o čemu se govori na Redditu nego izvorna Lemmy rasprava.
  • AI-kritične zajednice poput c/fuck_ai, s oko osam tisuća članova, ostvaruju najviše angažmana na temama nepovjerenja prema AI kompanijama, kao što su propusti u provedbi brisanja Googleovih podataka.
  • c/«メールアドレス» ima tri pretplatnika i nula objava, pa tehničkih rasprava o lokalnim LLM-ovima i otvorenim težinama na Lemmyju gotovo da nema. Potvrđena je samo jedna objava u drugoj zajednici, c/localllm, čiji tekst nije detaljno pregledan.
Ograničenja
  • Lemmy je malog opsega i nema aktivnu, specijaliziranu LLM zajednicu. Polovica od deset stavki ovog puta — #7 do #10, odnosno u praksi većina ako se uračuna tema o kineskim laboratorijima — potječe od Reddit zrcala c/ai_reddit i teško ih je smatrati izvornim Lemmyjevim diskursom.
  • c/«メールアドレス», s tri pretplatnika i bez objava, nije dao rezultate. Tehničke teme otvorenih modela, poput benchmarkova ili promjena cijena API-ja, na Lemmyju gotovo nisu pronađene.
  • Pretraživanje preko API-ja obuhvatilo je i instance izvan lemmy.worlda, poput lemmy.ml i lemm.ee, no nisu pronađene značajnije, neduplicirane objave za današnji datum osim navedenih 10.
  • Detaljno su proučeni samo reprezentativni tekstovi objava i komentari; nisu pregledani svi komentari.

Preporučene akcije

  • Promijeniti upite za Reddit na nazive modela i kompanija, poput GPT-6, Claude Opus 5.5 i open weight, pa ponovno prikupiti podatke.
  • Ponovno prikupiti X podatke bez oslanjanja na regionalne trendove, uz eksplicitne AI hashtagove i račune poznatih AI komentatora.
  • Prioritetno pratiti nastavke sudskog spora Anthropica i Pentagona te skepticizma prema sigurnosnim porukama.
  • U sljedećem prikupljanju provjeriti potvrđuju li neovisni benchmarkovi ocjene za Xiaomi MiMo V2.6 Pro.

Napomena o kvaliteti podataka

Dok su Reddit i X zbog pogrešnog dizajna upita — podudaranja općih riječi i nepovezanih regionalnih trendova — donijeli gotovo nula stvarnih uvida, YouTube, Bluesky i Lemmy prikupili su broj stavki blizak kriteriju dovršenosti te se neovisno podudarili u zaključku o raspravi Opus 5.5/GPT-6 i usponu Xiaomija.