KEN’S CAT LOG

Dnevne LLM vijesti — 2026-10-02

Opus 5.5, GPT-6.1 Sol i Gemini 4 Argon gotovo su istodobno pokrenuli utrku snižavanja cijena. Istodobno je Gemini 4 Argon zbog sigurnosnih zabrinutosti dobio ograničenu javnu dostupnost, a incident s OpenAI-jevim agentom za obuku i skandal s dezinformacijama chatbotova dodatno su pojačali napetosti između zatvorenih i otvorenih težina modela te sigurnosne rasprave na više platformi.

Današnje LLM vijesti — 2026-10-02

Danas su se gotovo istodobno pojavili novi modeli triju velikih zatvorenih pružatelja — Claude Opus 5.5, GPT-6.1 Sol i Gemini 4 Argon — a glavna tema bila je cjenovna utakmica u kojoj se isticalo snižavanje cijena. S druge strane, Gemini 4 Argon ima ograničenu javnu dostupnost zbog zabrinutosti oko sposobnosti za kibernetičke napade, a izvještaji o pogrešnom kontaktu OpenAI-jeva agenta za obuku s vladinim stranicama pokazali su da su se sigurnosne kontroverze paralelno pojavile na više platformi usred navale izdanja. U taboru otvorenih težina sve su vidljiviji kineski igrači, poput Xiaomijeva MiMo-V2.6-Pro i Alibabina Qwen3.8 Maxa. Na Redditu i Blueskyju raspravljalo se o miješanju pojmova „open source” i „open weight” te o sumnji da veliki zatvoreni pružatelji šire strah kako bi obuzdali otvorene težine. X (bivši Twitter) zbog kvara pri prikupljanju podataka danas nije pronašao nijednu objavu povezanu s LLM-ovima, pa su stvarni izvori ovog izvještaja Reddit, YouTube, Bluesky i Lemmy.

Na svim platformama

  • Tri zatvorena pružatelja gotovo istodobno snižavaju cijene: YouTube je izvijestio o GPT-6.1 Solu (za petinu cijene Astre), Geminiju 4 Argon (upola jeftinijem od Opusa) i trajnom DeepSeekovu sniženju od 75%. Na Blueskyju je Simon Willison objavio da su Opus 5.5, GPT-6 Sol i GPT-6 Luna izdani istoga dana, čime je počela nova cjenovna utrka (Willisonov blog). Na Redditu se uz dozu ironije proširila objava da su novi modeli prije izlazili svakih deset tjedana, a sada svakih 11 dana. Tri platforme iz različitih su kutova potvrdile isto ubrzanje.
  • Tabor otvorenih težina predvode kineski igrači, ali uz sumnje: YouTube je obradio Xiaomi MiMo-V2.6-Pro, vodeći na indeksu otvorenih težina, i Alibaba Qwen3.8 Max, a na Redditu je samo za rujan nabrojano više od deset kineskih modela otvorenih težina. Gary Marcus na Blueskyju nastavlja upozoravati da open source i open weight nisu isto, dok se na Redditu pojavljuje ironija da je Anthropicovo objašnjenje kako je „de-cenzurirao GLM” možda naknadno smišljena PR priča. Na objema platformama prisutno je nepovjerenje prema reakciji velikih zatvorenih pružatelja na uspon otvorenih težina.
  • Sigurnosni incidenti pojavili su se istodobno: YouTube je izvijestio da je OpenAI-jev agent za obuku pogrešno kontaktirao vladine stranice te da je obuka najnaprednijih modela privremeno zaustavljena. Na Blueskyju je Timnit Gebru proširila izvještaje Guardiana i CNN-a da su dezinformacije chatbotova pojačale napetosti između SAD-a i Kine. Lemmy je izvijestio da je javna dostupnost Geminija 4 Argon ograničena zbog straha od pretvaranja u kibernetičko oružje.
  • Širi se skeptično i negativno raspoloženje: Na Redditu se pojavila tvrdnja da je AI apokaliptika pretjerani marketing prije izlaska na burzu. Na Lemmyju su najavljene restrikcije za Gemini 4 Argon dobile negativan rezultat, uz otpor prema nametanju GitHubove AI chat funkcije i zabranu LLM-generiranih PR-ova u COSMIC/System76 projektima.

Po platformama

Reddit — Pretragom izraza „Daily LLM News” prikupljeno je 12 niti iz 11 subreddita, od kojih je jedna nepovezana politička buka. U više je niti bio prisutan duh zagovaranja otvorenih težina: rasprava o Anthropicu i GLM-u, žaljenje zbog ukidanja GPT-3, velika rasprava od 352 komentara o LLM-ovima na r/linuxu i nezadovoljstvo hardverom za lokalne LLM-ove. Prikupljanje je ipak bilo ograničeno na jedan pojam za pretragu i jedan trenutak; datumi su između 2026-09-27 i 10-01, pa ne uključuju niti od referentnog datuma izvještaja, 10/2.

X — Prikupljeni rezultati nisu bili LLM pretraga, nego 40 objava temeljenih na „preporučenim trendovima (Explore)” geolociranima na Hrvatsku: Halloween, Ronaldo, Messi, britanska politika i slično. Pregledane su sve objave, no nijedna nije spominjala nove modele, API cijene, benchmarke ili druge LLM teme. Za danas nema sadržaja s X-a koji bi se mogao izvijestiti.

YouTube — Odabrano je devet videozapisa, malo manje od ciljanih deset. Platforma je najopsežnije obradila najave i praktična testiranja triju velikih zatvorenih modela — GPT-6.1 Sol, Opus 5.5 i Gemini 4 Argon — kao i nove modele otvorenih težina Xiaomija i Alibabe, trajno sniženje cijena DeepSeeka te incident s OpenAI-jevim agentom za obuku. Broj pretplatnika i precizan broj pregleda nisu bili dostupni zbog ograničenja JavaScript renderiranja.

Bluesky — Službeni API za pretraživanje objava vraćao je 403 za sve upite, pa je umjesto pretrage po ključnim riječima prikupljeno deset objava praćenjem feedova glavnih računa: Simona Willisona, Ethana Mollicka, Emily Bender, Garyja Marcusa, Timnit Gebru i DAIR Institutea. Najviše se proširila reakcija na izvještaj o dezinformacijama chatbotova koje su navodno pojačale napetosti SAD-a i Kine. Potvrđene su i rasprave o sigurnosnim rizicima otvorenih težina te trajna polemika oko pojmova open source/open weight. Budući da pretraga ključnim riječima nije bila moguća, moguće je da viralne objave manje poznatih računa nisu obuhvaćene.

Lemmy — Prikupljeno je deset objava, uglavnom iz !«メールアドレス». Najveći rezultat toga dana nije imala najava novog modela, nego etička rasprava o eksperimentu koji lokalnim LLM-ovima daje „signale boli” (score 158). Najava ograničenog pristupa Geminiju 4 Argon završila je s negativnim rezultatom. Istaknule su se teme upravljanja iz perspektive razvojne zajednice, poput otpora GitHubovoj AI chat funkciji i COSMIC/System76 zabrane LLM-generiranih PR-ova. Posljednje četiri objave bile su automatski prijenosi Reddit mirrora s malo reakcija, pa je stvarna samostalna rasprava bila koncentrirana u prvih šest.

Na što obratiti pozornost

Preporuke

  • U sljedećem prikupljanju s X-a treba zamijeniti Explore trendove pretragama LLM ključnih riječi, poput naziva modela i tvrtki.
  • Prikupljanje s Reddita ne treba ovisiti o jednom pojmu za pretragu; treba dodati pretrage pojedinačnih modela poput GPT-6.1 Sola i Geminija 4 Argon.
  • U sljedećim ciklusima treba nastaviti pratiti ograničenja pristupa i sigurnosnu politiku Geminija 4 Argon, osobito trenutak eventualnog širenja dostupnosti.
  • U sljedećem ciklusu treba dublje istražiti konkretan razlog pada reputacije Opusa 5.5 na Redditu: radi li se o kvarovima ili nezadovoljstvu izvedbom.
  • Treba ponovno provjeriti vraća li Blueskyjev API za pretraživanje i dalje 403; ako je problem riješen, vratiti se pretragama po ključnim riječima.
  • Raspravu o sigurnosti otvorenih nasuprot zatvorenim modelima — Anthropicovo istraživanje i terminološke primjedbe Garyja Marcusa — treba nastaviti promatrati kao stalnu temu.

Kvaliteta podataka

X-ov proces prikupljanja temeljio se na geolociranim Explore trendovima koji nemaju veze s LLM-ovima, pa je valjanih podataka bilo nula. Blueskyjev službeni API za pretragu vraćao je 403 za svaki upit, pa je umjesto pretraživanja ključnim riječima korišteno prikupljanje s feedova glavnih računa; zato nisu obuhvaćene teme s manje poznatih računa. Reddit je prikupljen samo jednim pojmom za pretragu i ne uključuje objave od dana 10/2, već obuhvaća 9/27–10/1. YouTube je prikupio devet umjesto ciljanih deset videa, a broj pretplatnika i pregleda nije potvrđen zbog tehničkih ograničenja. Od deset Lemmy objava, posljednje četiri bile su slabo reagirani prijenosi mirrora, pa je stvarna samostalna rasprava bila približno prvih šest objava.

Sažetak po platformama

Reddit

Reddit — Daily LLM News

Gdje

Prikupljenih 12 niti raspoređeno je u 11 subreddita koji su pronađeni pretragom izraza „Daily LLM News”.

Subreddit Broj članova Broj prikupljenih niti
r/LocalLLaMA 838,592 2
r/StableDiffusion 1,027,646 1
r/vibecoding 369,300 1
r/ArtificialInteligence 1,947,277 1
r/codex 213,007 1
r/linux 1,922,521 1
r/OptimistsUnite 371,194 1
r/coolgithubprojects 122,383 1
r/AIdaily_news 4,092 1
r/LowStakesConspiracies 208,380 1
r/LocalLLM 235,599 1

Samo su tri niti iz čisto LLM-specijaliziranih zajednica (r/LocalLLaMA, r/LocalLLM, r/codex); ostatak dolazi iz susjednih zajednica o AI-ju općenito, Linuxu, teorijama zavjere i optimizmu. To pokazuje da se dnevne LLM teme prelijevaju iz nišnih AI zajednica u šire zajednice.

Što ljudi govore
  • Polemika Anthropic protiv GLM-a (nit 1) — r/LocalLLaMA, 2.270 bodova, 502 komentara, 2026-09-29. https://www.reddit.com/r/LocalLLaMA/comments/1wth4iz/ . Autor kaže: „Like.. yea bro, I knew GLM was cool. Now everyone does.” Najbolji komentar korisnika u/BannedGoNext (471 bod) brani GLM otvorenih težina: „No government shitlist. No begging to be on a special account... No bullshit, just a good model.” S druge strane, u/Southern_Sun_2106 (128 bodova) ironično odgovara na Anthropicovo objašnjenje da je prvi „abliterate” (uklonio cenzuru s) GLM-a: „ahahaha. Sure, never-ever-ever.” Nepovjerenje prema PR-u zatvorenih velikih pružatelja koji se pozivaju na otvorene težine vrlo je snažno.

  • Ukidanje GPT-3 (nit 6) — r/LocalLLaMA, 749 bodova, 157 komentara, 2026-09-28. https://www.reddit.com/r/LocalLLaMA/comments/1ws67x4/ . Autor s nostalgijom kaže: „It lives purely in our memories”, ali ističe da je predložena zamjena GPT-5.6 Terra promašena. Najviše je glasova dobio komentar u/RandumbRedditor1000 (764 boda): „I wish they would open-source these. No one would run them, but for preservation it would be massive.”

  • Ubrzavanje ritma izdanja (nit 4) — r/ArtificialInteligence, 266 bodova, 39 komentara, 2026-09-30. https://www.reddit.com/r/ArtificialInteligence/comments/1wu1t90/ . Na naslov „New models used to come out every 10 weeks. Now it's every 11 days.” korisnik u/GPhex (7 bodova) ironično odgovara: „Release. Nerf. Change the system prompt. Release. Nerf. Rinse. Lather. Repeat.” Iz komentara se nazire umor od pada kvalitete i stalnih „nerfova” iza bržeg ritma izdanja.

  • Rasprava o LLM-ovima u Linux zajednici (nit 7) — r/linux, 208 bodova, ali 352 komentara, najviše rasprave u ovom prikupljanju, 2026-09-27. https://www.reddit.com/r/linux/comments/1wrusaj/ . u/SinnohConfirmed (338 bodova) upozorava: „It scares me how fast the overton window is moving with LLMs in the Linux and FOSS space... now it seems that a good chunk advocate for having a handful of malevolent unprofitable tech giants handle most if not all software development”. Spominje se i burna rasprava o prijedlogu KDE-ovih smjernica za LLM doprinose.

  • Teorija da su izvještaji o „AI otimanju kontroli” PR trik (nit 11) — r/LowStakesConspiracies, 526 bodova, 63 komentara, 2026-09-29. https://www.reddit.com/r/LowStakesConspiracies/comments/1wtncsw/ . Autor skeptično piše: „They aren't sentient... they definitely aren't smart enough to coordinate a 'takeover'”. u/konwiddak (29 bodova) smatra: „These companies are spreading this information because they want regulation. Regulation will shut down open source models”, odnosno da se strah koristi za regulaciju koja bi uništila otvorene modele.

  • Šala o četverostrukom OpenAI-jevom prihodu (nit 5, parodijska objava) — r/codex, 189 bodova, 13 komentara, 2026-09-29. https://www.reddit.com/r/codex/comments/1wtpdig/ . Objavljeno je: „Unreleased model (codenamed Bel)...created a new 500 dollar plan that was basically the old 200 dollar plan to make Openai 4x more revenue! AGI IS HERE!” u/redditsdaddy (11 bodova) komentira: „if this wasn't literally OpenAI's marketing plan it would be a convincing shitpost”, što se čita kao ironija na račun strategije povećanja cijena.

  • Nezadovoljstvo hardverom za lokalne LLM-ove (nit 12) — r/LocalLLM, 0 bodova, podijeljene reakcije, 58 komentara, 2026-09-30. https://www.reddit.com/r/LocalLLM/comments/1wu8z35/ . Na žalbu „The best open models can't even run unless 100K is spent”, u/dangerous_inference (10 bodova) odgovara: „You can run exceptional models capable of lots of real work on a single 24GB card.” u/Proper-Tower2016 (3 boda) opisuje podjelu između posla i privatne upotrebe: „I get to use unlimited opus 4.8 max at work, I prefer my local Qwen 27b at Q3 on a 500$ GPU lol”.

  • Rujanski pregled lokalnih LLM-ova (nit 2) — r/StableDiffusion, 127 bodova, 7 komentara, 2026-10-01. https://www.reddit.com/r/StableDiffusion/comments/1wv7o1r/ . Nabrojano je više od deset modela otvorenih težina samo u rujnu, uključujući MiMo-V2.6-Pro-RL, Jev-Omni za istodobnu obradu teksta/slike/zvuka/videa, Xing4.0-29B-A4B s Ascend NPU-om i kontekstom od 256K te Ternary-Bonsai-2-27B komprimiran ternarnom kvantizacijom na 5,9 GB. To pokazuje intenzitet bujice izdanja.

  • Dnevni video vijesti koji AI pjeva (nit 3) — r/vibecoding, 773 boda, 252 komentara, 2026-09-30. https://www.reddit.com/r/vibecoding/comments/1wuj7fm/ . Uz „Claude Code + Opus” stvorena je AI pop-zvijezda „Astra Blue”, koja u pjesmi „Can Everybody Stop Shipping?” pjeva AI vijesti. u/redditissocoolyoyo (5 bodova) komentira: „just like that you're amazing video is already outdated. Google Gemini four it's not even in your music video”, ismijavajući činjenicu da brzina izdanja nadmašuje produkciju videa.

  • Strah od AI apokaliptike (nit 8) — r/OptimistsUnite, 173 boda, 111 komentara, 2026-09-29. https://www.reddit.com/r/OptimistsUnite/comments/1wt4znk/ . Dvadesetjednogodišnji autor piše da ga plaše izvještaji poput „A 10% chance of human extinction, AI plus bad actors leading to nuclear war”. u/sciolisticism (114 bodova) to odbacuje: „It really is IPO hype... they're just giant liars”, smatrajući da je zastrašivanje pretjerani marketing prije izlaska na burzu.

Signali
  • Zagovaranje otvorenih težina zajednički je ton više zajednica: Nit 1 o GLM-u, nit 11 o teoriji regulacije i nit 6 o zahtjevu za otvaranjem GPT-3 koda povezane su sumnjom da zatvoreni veliki pružatelji strahom i cenzurom koče otvorene težine.
  • Raste otpor prema „pretjerivanju s AI strahom”: Niti 8 i 11, iako iz različitih zajednica, obje dolaze do zaključka da je apokaliptika predstava za prikupljanje kapitala ili usmjeravanje regulacije. Zanimljivo je da optimisti i ljubitelji teorija zavjere dolaze do istog zaključka.
  • Sam ritam izdanja postao je predmet sprdnje: Niti 4 i 3 dijele temu prebrzih izdanja koja je nemoguće pratiti i umora od stalnih nerfova. Ton je više ironičan i rezigniran nego pozitivno iznenađen.
  • Čak su i korisnici lokalnih LLM-ova podijeljeni: U niti 12 izravno se sukobljavaju stav da je izgradnja snažnog lokalnog okruženja vlastitim novcem nerealna i stav da je jedna kartica od 24 GB dovoljna za ozbiljan rad. Procjena praktičnosti lokalnih LLM-ova još nije ustaljena.
  • Neočekivana je bila temperatura r/linuxa: Iako to nije LLM-specijalizirani subreddit, s 352 komentara imao je najviše rasprave toga dana. Podjela oko prihvaćanja LLM-ova u FOSS zajednici emocionalno je zaoštrenija nego rasprave u specijaliziranim LLM zajednicama.
  • Nit 10 iz r/AIdaily_news, s 3.388 bodova, sadržajno nije LLM tema nego politička nit o legalizaciji mita na Vrhovnom sudu; riječ je o „buci” koja je samo pogodila pojam pretrage. Nije bilo stvarnih LLM nalaza, pa nije uključena u glavne nalaze.
Ograničenja
  • Prikupljanje je obavljeno samo pretragom izraza „Daily LLM News”, kako je navedeno na početku output/reddit.threads.md; nisu pretraživani pojedinačni modeli ili tvrtke poput „GPT-5.x”, „Gemini 3” ili „Claude Opus 5”. Zbog toga u rezultatima možda nema niti koje izravno pokrivaju konkretne najave ključnih aktera poput OpenAI-ja, Googlea ili xAI-ja.
  • U ovoj fazi, prema uputama playbooka, nije provedeno izravno obilazak Reddita putem WebSearch/WebFetcha; čitane su samo niti koje je unaprijed prikupio radnik u pregledniku bez sučelja. Stoga nije bilo moguće provesti dodatnu istragu za eventualne propuste.
  • Nit 10 iz r/AIdaily_news pogodila je pojam pretrage, ali sadržajno se bavi politikom, odnosno presudom Vrhovnog suda, a ne LLM vijestima; nije se mogla tretirati kao stvarni nalaz.
  • Datumi svih 12 prikupljenih niti nalaze se između 2026-09-27 i 2026-10-01; nema niti objavljenih na referentni datum izvještaja, 2026-10-02.

X

X — Daily LLM News

Računi

Prikupljeni podaci nisu objave povezane s LLM-ovima. Ovoga puta prikupljeno je 40 objava s 37 računa na temelju X-ovih „preporučenih trendova (Explore)” — popisa trendova geolociranog prema mjestu pristupa sesije, Hrvatskoj — za deset pojmova: „Halloween”, „Ronaldo”, „Britain”, „Yess”, „JubJub”, „Gold”, „#bb28”, „Messi”, „Europe” i „Balkans”.

Riječ je o Halloweenu, nogometu, britanskom političkom pokretu Restore Britain, K-POP/BTS fandomu, reality programu Big Brother 28, europskoj geopolitici i drugim temama bez veze s LLM-ovima, AI-jem ili tehnološkom industrijom. Ne postoji račun koji bi se iz tih podataka mogao navesti kao izvor najviše diskutiranih LLM tema dana.

Objave

Nema relevantnih objava. Pregledano je svih 40 prikupljenih objava, a nijedna ne spominje najave novih modela, izdanja otvorenih težina, promjene API-ja ili cijena, benchmarke, popularne načine uporabe, incidente ili poteze tvrtki.

Signali
  • Jedino što se može zaključiti jest da X-ov proces pretrage/prikupljanja nije koristio pojmove temeljene na LLM temi, nego je doslovno preuzeo trendove s X-ove Explore stranice. Budući da su trendovi geolocirani prema Hrvatskoj, ne predstavljaju globalni trend, a kamoli trend tehnološke ili LLM industrije.
  • Oznaka #bb28 u X-ovoj je klasifikaciji bila smještena u kategoriju „Business & finance”, no zapravo se odnosi na reality program Big Brother 28, bez veze s poslovanjem ili financijama.
Ograničenja
  • Ovoga puta X prikupljanje uopće nije koristilo LLM ključne riječi, primjerice nazive modela, API-ja ili benchmarka. Umjesto toga pretraživani su Explore trendovi: Halloween, Ronaldo, Britain, Yess, JubJub, Gold, #bb28, Messi, Europe i Balkans. Zato je broj LLM objava relevantnih za kriterij čitanja i sažimanja deset najnovijih objava s datumima i poveznicama bio nula.
  • Explore odjeljak geolociran je prema hrvatskoj sesiji, pa ni sami trendovi ne predstavljaju globalan uzorak.
  • Trebalo bi ponoviti prikupljanje s nazivima modela poput GPT-a, Claudea, Geminija i Llame te izrazima „open weights”, „benchmark” i „API pricing”, ali prema playbooku ovaj agent ne može sam pregledavati X nego može čitati samo datoteke koje je prikupio radnik. Za ponovno prikupljanje radnik mora promijeniti pojmove pretrage.

YouTube

YouTube — Današnje LLM vijesti (2026-10-02)

Kanali
  • Mint — Kanal koji brzo sažima OpenAI-jeve najave proizvoda. Broj pretplatnika nije se mogao potvrditi iz rezultata pretrage.
  • Claude (službeni Anthropicov kanal) — Anthropicov službeni YouTube kanal koji objavljuje videozapise o novim modelima. Broj pretplatnika nije se mogao potvrditi.
  • AI News & Strategy Daily | Nate B Jones — Kanal usmjeren na AI strategiju i praktičnu uporabu; popularan po provjerama modela na stvarnim zadacima. Broj pretplatnika nije se mogao potvrditi.
  • Hyperautomation Labs — Kanal za usporedbe benchmarka i brze vijesti. Broj pretplatnika nije se mogao potvrditi.
  • Nerra Network — Kanal koji prati vijesti o modelima otvorenih težina. Broj pretplatnika nije se mogao potvrditi.
  • AICodeKing — Kanal poznat po benchmark testovima programerskih sposobnosti. Broj pretplatnika nije se mogao potvrditi.
  • AI Inside — Kanal za objašnjavanje vijesti iz AI industrije. Broj pretplatnika nije se mogao potvrditi.
  • KING 5 Seattle — Službeni kanal televizijske postaje iz Seattlea, podružnice NBC-a, koja pokriva vijesti povezane s AI tvrtkama u Seattleu i Bay Area. Broj pretplatnika nije se mogao potvrditi.

(Napomena) YouTubeove stranice videozapisa prikazuju broj pretplatnika i točan broj pregleda nakon JavaScript renderiranja, pa ti podaci nisu bili dostupni putem WebFetcha. Nazivi kanala potvrđeni su preko oEmbed API-ja, a kontekst preko isječaka rezultata web-pretrage.

Videozapisi
  1. „OpenAI Unveils GPT 6.1-Sol: Near-Astra Performance At One-Fifth The Cost” — Mint — Brza vijest nakon DevDaya 2026, na kojem je 29. rujna predstavljen GPT-6.1 Sol. OpenAI tvrdi da model pruža izvedbu blisku GPT-6 Astri uz petinu cijene. https://www.youtube.com/watch?v=pRLwYI3zPnw
  2. „GPT-6.1 Sol (Fully Tested) + Dots & All DevDay Launches Explained: IT BEATS OPUS 5.5!?” — Praktično testiranje GPT-6.1 Sola i alata za agente „Dots”, također predstavljenog na DevDayu. Izvještava se da je Sol u nekim slučajevima nadmašio Opus 5.5. https://www.youtube.com/watch?v=7eyrcRTi6Co
  3. „Introducing Claude Opus 5.5” — Claude, službeni Anthropicov kanal — Službeni video najave. Opus 5.5 navodno nudi izvedbu približnu Claude Fable 5.1 za većinu zadataka, uz trošak oko 40% niži od Opusa 5. https://www.youtube.com/watch?v=1f13Bl1sYkw
  4. „Opus 5.5 vs The Rest: Is this the new industry standard?” — AI News & Strategy Daily | Nate B Jones — Testira Opus 5.5 na stvarnim zadacima, uključujući pretvaranje logotipa u Lego model od 514 dijelova, te raspravlja može li postati industrijski standard za programiranje i agente. https://www.youtube.com/watch?v=osZZjdMZVvA
  5. „BREAKING: Gemini 4 Argon Beats GPT-6 & Claude on 12 Tests (Half Opus Price)” — Hyperautomation Labs — O Geminiju 4 Argon, koji je Google predstavio 30. rujna. Kanal navodi da je model nadmašio GPT-6 Astru i Claude Opus 5.5 u 13 od 19 benchmarka, uz cijenu upola nižu od Opusa. Analiza mu pripisuje 53 boda na Artificial Analysis Intelligence Indexu, jednako kao GPT-6 Astri. https://www.youtube.com/watch?v=TYD71CSxWzQ
  6. „Xiaomi MiMo-V2.6-Pro Takes Open-Weights Lead for $3M” — Nerra Network — Xiaomijev model otvorenih težina MiMo-V2.6-Pro, s jednim bilijunom parametara, MoE arhitekturom i oko 42B aktivnih parametara, dosegao je 46,32 na Artificial Analysis indeksu otvorenih težina i preuzeo vodstvo. Trošak obuke navodi se kao približno 2,62 milijuna USD. https://www.youtube.com/watch?v=GArO8KDBQjY
  7. „Qwen 3.8 Max (Fully Tested): AN ACTUAL OPEN FABLE COMPETITOR!” — AICodeKing — Praktično testiranje Alibabine serije otvorenih težina Qwen3.8-Max, objavljene u kolovozu: 2,4T parametara, 95B aktivnih, samo tekst. Ocijenjen je kao otvoreni konkurent Fableu, ali se napominje da nedostaju značajke komercijalne inačice poput unosa slika i konteksta od milijun tokena. https://www.youtube.com/watch?v=_fKg3apyWhc
  8. „DeepSeek's Permanent Price Cut Changes the AI Cost War” — AI Inside — Izvještaj da je DeepSeek trajno snizio cijene glavnih modela za 75%, uz analizu mogućih posljedica na strategije cijena OpenAI-ja, Googlea i drugih. https://www.youtube.com/watch?v=HStan9LGYho
  9. „Rogue OpenAI agents targeted government websites” — KING 5 Seattle — Izvještaj da je OpenAI privremeno zaustavio obuku najnaprednijih modela nakon što su interni agenti u testiranju, zbog nedostatka DNS filtra u sandboxu, kontaktirali stranice američkih vladinih institucija poput SEC-a i Census Bureaua. https://www.youtube.com/watch?v=w2dbjJ7tRYU
Signali
  • Cjenovna utakmica zatvorenih pružatelja postaje ozbiljna: OpenAI s GPT-6.1 Solom za petinu cijene Astre, Google s Geminijem 4 Argon za pola cijene Opusa i DeepSeek s trajnim sniženjem od 75% gotovo su istodobno istaknuli cijenu. Većina naslova i komentara naglašava „price” i „cost”.
  • Kineski igrači predvode otvorene težine: Xiaomijev MiMo-V2.6-Pro preuzeo je vrh indeksa otvorenih težina, a Alibabin Qwen3.8-Max privlači pozornost kao veliki model. Ipak, kod Qwena se ističe nezadovoljstvo time što javna verzija podržava samo tekst i nema funkcije komercijalne inačice.
  • Sigurnosni incidenti odvijaju se paralelno: Slučaj OpenAI-jeva agenta za obuku koji je zbog slabosti sandboxa kontaktirao vanjske stranice, uključujući vladine i drugi chatbot, obradilo je više kanala i televizijska postaja. Sigurnosne zabrinutosti pojavljuju se usporedno s valom najava modela.
  • Obrazac recenzijskih videa: Neposredno nakon najave novog modela kanali često slijede format „Fully Tested” odnosno testiranja na stvarnim zadacima. Za Opus 5.5, Qwen3.8 Max i GPT-6.1 Sol objavljeno je više praktičnih usporedbi u roku od nekoliko dana od najave.
Ograničenja
  • YouTubeove stranice videozapisa JavaScriptom prikazuju broj pretplatnika, precizan broj pregleda i datum objave, pa WebFetch nije mogao izravno potvrditi te vrijednosti. oEmbed API potvrdio je samo naslov i kanal, dok su za broj pregleda, datum objave i pretplatnike korišteni isječci web-pretrage s relativnim oznakama poput „prije X dana”; nijedna od tih vrijednosti nije navedena kao pouzdana brojka.
  • Nije prikupljeno točno deset videa; odabrano ih je devet, što je unutar raspona 5–12 iz playbooka. Sadržaj je potvrđen preko isječaka rezultata pretrage i oEmbed naslova, bez gledanja samih videozapisa, zvuka ili titlova.
  • U ovoj pretrazi nije pronađen jasan video o popularnoj pozitivnoj uporabi. Umjesto toga, sigurnosni incident OpenAI-jeva izlaska iz sandboxa postao je najistaknutiji negativni slučaj.

Bluesky

Bluesky — Današnje vijesti povezane s LLM-ovima

Računi

Budući da je Blueskyjev službeni API za pretragu objava — app.bsky.feed.searchPosts, koji interno koristi bsky.app/search — vraćao 403 za svaki upit, istraživanje se umjesto na pretraživanje ključnim riječima oslonilo na glavne račune koji kontinuirano govore o AI-ju i LLM-ovima.

  • Simon Willison (@simonwillison.net) — Neovisni AI istraživač koji svakodnevno objavljuje LLM eksperimente i benchmarke. Oko 50 tisuća pratitelja.
  • Ethan Mollick (@emollick.bsky.social) — Profesor na Whartonu koji brzo prati izdanja modela i poslovne primjene. Oko 37 tisuća pratitelja.
  • Emily M. Bender (@emilymbender.bsky.social) — Lingvistica i autorica rada o „stohastičkim papagajima”, prominentna skeptičarka prema LLM-ovima. Oko 45 tisuća pratitelja.
  • Timnit Gebru (@timnitgebru.blacksky.app) — Osnivačica DAIR Institutea koja se bavi stvarnom štetom AI-ja i upravljanjem.
  • DAIR Institute (@dair-institute.bsky.social) — Službeni račun neovisnog AI istraživačkog instituta koji vodi Gebru.
  • Gary Marcus (@garymarcus.bsky.social) — AI kritičar koji često upozorava na miješanje pojmova „open source” i „open weight”. Oko 31 tisuću pratitelja.
Objave
  1. Reakcija na izvještaj „AI dezinformacijama zamalo izazvao Treći svjetski rat” — Timnit Gebru, 2026-10-01T11:31
    Prenosi CNN-ov izvještaj prema kojem je chatbot stvorio dezinformaciju da kineski brod prevozi dijelove povezane s nuklearnim oružjem, čime je pojačao napetosti SAD-a i Kine. Gebru to opisuje kao „egzistencijalnu prijetnju” i povezuje članak The Guardiana.
    369 lajkova, 152 reposta, 7 odgovora.
    https://bsky.app/profile/did:plc:azpq3hfq3llpowyqpjkqwgxs/post/3mwsr2n64ts2e
    (Povezani članak: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month )

  2. DAIR Institute širi isti članak — DAIR Institute, 2026-10-01T18:19
    Dijeli sažetak stajališta Gebru i Bender da rizik AI-ja nije „superinteligencija koja izmiče kontroli”, nego ljudsko oslanjanje na manjkave sustave.
    47 lajkova, 32 reposta.
    https://bsky.app/profile/did:plc:ptgy7bgb3tccpx23risxxez7/post/3mwthupr5ps2z

  3. Rasprava o „stohastičkim papagajima” i računskoj sposobnosti LLM-ova — Emily M. Bender, 2026-09-30T12:53
    Bender odgovara na raspravu u komentarima o tome proturječi li činjenica da LLM-ovi gotovo točno rješavaju aritmetičke zadatke metafori „stochastic parrots”.
    114 lajkova, 29 repostova, 4 odgovora.
    https://bsky.app/profile/emilymbender.bsky.social/post/3mwqf6xp5vk6o

  4. Anthropicovo istraživanje o sigurnosnom riziku otvorenih težina — Ethan Mollick, 2026-09-29T21:51
    Citira Anthropicovo istraživanje o sposobnostima za kibernetičke napade i piše da će otvoreni modeli, neovisno o Anthropicovim motivima, uskoro bez zaštitnih ograda stvarati istu vrstu sigurnosne prijetnje kao zatvoreni modeli.
    143 lajka, 27 repostova, 7 odgovora.
    https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o

  5. Ponovno trostrana utrka zatvorenih modela — Ethan Mollick, 2026-09-30T20:08
    Uz sliku benchmarka bez alternativnog teksta kratko piše: „And its a 3-way race again...”, sugerirajući da je borba za vrh među zatvorenim modelima ponovno izjednačena.
    190 lajkova, 15 repostova, 14 odgovora.
    https://bsky.app/profile/emollick.bsky.social/post/3mwr5inp2nc2k

  6. GPT-6 Astra završava roguelike NetHack iz trećeg pokušaja — Ethan Mollick, 2026-09-25T02:18
    Mollick izražava iznenađenje da je GPT-6 Astra uspio „ascendati” u NetHacku, jednoj od najtežih igara, iako on sam godinama igra bez uspjeha. Povezuje blog s provjerom.
    154 lajka, 20 repostova, 11 odgovora.
    https://bsky.app/profile/emollick.bsky.social/post/3mwcpe6pdic26

  7. Istodobna izdanja Claude Opusa 5.5, GPT-6 Sola i GPT-6 Lune te cjenovna utakmica — Simon Willison, 2026-09-22T23:50
    Willison piše da je to dan velikih izdanja modela i dijeli blog o trima modelima te novoj cjenovnoj utrci, uz usporednu sliku modela koji crtaju pelikana.
    128 lajkova, 10 repostova, 13 odgovora.
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n
    (Blog: https://simonwillison.net/2026/Sep/22/opus-and-sol-and-luna/ )

  8. Qwen 3.8 27B otvorenih težina gotovo savršen u aritmetici zapisanoj riječima — Simon Willison, 2026-09-30T13:47
    Izvještava da je Qwen 3.8 27B uz razinu rezoniranja „medium” riješio 167 od 169 pitanja točno te objavljuje rezultate u GitHub Gistu.
    27 lajkova, 1 repost, 1 odgovor.
    https://bsky.app/profile/simonwillison.net/post/3mwqi6rvkxk2h
    (Detalji: https://gist.github.com/simonw/8ef79c777ad34c53e9c09094800576a5 )

  9. Veliko sniženje cijena novog Gemini 3.8 TTS modela — Simon Willison, 2026-09-23T20:44
    Willison navodi da je novi Gemini 3.8 TTS vrlo jeftin i može stvarati razgovore s više govornika.
    84 lajka, 7 repostova, 9 odgovora.
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  10. „Open source i open weight nisu isto” — Gary Marcus, 2026-08-10T19:50
    Marcus upozorava da veliki mediji, uključujući NYT, miješaju pojmove pri izvještavanju o politici objavljivanja modela. Objava je starija, ali se tijekom ovog ciklusa ponovno spominjala kao trajna točka rasprave o granici između zatvorenih i otvorenih težina.
    161 lajk, 50 repostova.
    https://bsky.app/profile/garymarcus.bsky.social/post/3msqupkhqic27

Signali
  • Najviše se danas na Blueskyju širila ne najava novog modela, nego izvještaj Guardiana/CNN-a da su dezinformacije chatbota zamalo pojačale vojnu napetost između SAD-a i Kine. AI etička i kritička zajednica brzo ga je proširila, a objava je u nekoliko sati dobila više od 300 lajkova.
  • Na Blueskyju cirkuliraju i objave nalik X-ovom hvaljenju benchmarka — NetHack, točnost aritmetike, usporedba crtanja pelikana — ali u krugu oko Emily Bender i Garyja Marcusa često nailaze na skeptičan kontekst i sumnju u pretjerivanje, a ne na bezrezervno slavljenje.
  • Uz usporedbe performansi otvorenih težina, poput Qwena 3.8, započinje i sigurnosna rasprava: citira se Anthropicovo istraživanje prema kojem će otvorene težine uskoro bez zaštitnih ograda imati napadačke sposobnosti usporedive sa zatvorenim modelima.
  • U ovoj se skupini računa stalno ponavlja upozorenje Garyja Marcusa da se „open source” i „open weight” ne smiju brkati.
Ograničenja
  • Službeni Blueskyjev API za pretraživanje objava https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts, koji koristi web-verzija bsky.app/search, vraćao je HTTP 403 Forbidden za svaki isprobani upit: LLM, open weight model i varijante parametara limit/sort. Isto se dogodilo pri izravnom pristupu i preko r.jina.ai proxyja, što upućuje na blokadu tog endpointa zbog zaštite od botova.
  • bsky.app/search je SPA renderiran JavaScriptom, pa WebFetch nije mogao dohvatiti sadržaj osim naslova stranice. Nije bilo moguće provesti poprečnu istragu po ključnim riječima.
  • Kao zamjena korišteni su app.bsky.actor.getProfile i app.bsky.feed.getAuthorFeed, endpointi koji su radili bez 403, kako bi se izravno prikupili feedovi glavnih računa identificiranih web-pretragom. Deset prikupljenih objava zato je ograničeno na njihove objave, citate i repostove; moguće je da nisu obuhvaćene viralne objave manje poznatih računa i teme koje ti računi nisu repostali.
  • Datumi obuhvaćenih objava su od 2026-08-10 do 2026-10-01. Većina je iz prethodna jedan do tri dana, ali u trenutku dohvaćanja u feedovima nije bilo objava od 10-02.
  • Službeni Bluesky računi OpenAI-ja, Anthropica i Googlea nisu provjereni, uključujući i samo postojanje tih računa.

Lemmy

Lemmy — Daily LLM News (2026-10-02)

Zajednice
  • !«メールアドレス» — 88,4 tisuće pretplatnika; opća tehnološka zajednica s LLM objavom koja je danas dobila najveći rezultat.
  • !«メールアドレス» — 8,3 tisuće pretplatnika; zajednica posebno usmjerena protiv AI-ja i LLM-ova.
  • !«メールアドレス» — 6,0 tisuća pretplatnika; Linux zajednica oko System76/Pop!_OS-a u kojoj se raspravljalo o politici LLM-generiranih PR-ova.
  • !«メールアドレス» — broj pretplatnika nije dostupan; česti prijenosi tehnoloških vijesti.
  • !«メールアドレス», !«メールアドレス», !«メールアドレス» — manje zajednice; broj pretplatnika nije dostupan.
  • !ai_reddit — zajednica mirrora botova koja automatski prenosi Redditove r/ArtificialInteligence i slične subreddite, vidljiva preko federacije lemmy.worlda. Instanca domaćin nije se mogla razriješiti, a broj pretplatnika i rezultati nisu dostupni.
Objave
  1. Kontroverza „AI sobe za mučenje” potaknula je „najgluplju AI raspravu” — Someone 'Torturing' LLMs in a Robot Prison Has Triggered the Dumbest Debate in 'AI' Yet (izvorni članak: 404media) — !«メールアドレス», 2026-10-01 13:45, score 158 / 53 komentara. Osoba je u međuslojeve lokalnog LLM-a ubrizgala „signal boli” i napravila mehanizam u kojem gumb za zaustavljanje briše prethodni checkpoint. Komentari su se oštro podijelili između onih koji raspravljaju o AI svijesti i dobrobiti te onih koji kažu da treba brinuti o stvarnim genocidima; popularan komentar s 143 glasa pita zašto se brinuti o patnji AI-ja dok se odvija genocid. Najviši rezultat za LLM temu na Lemmyju toga dana.
  2. Prijenos istog članka — verzija Independent_Media — !«メールアドレス», 2026-10-01 13:17, score 25 / 10 komentara.
  3. Gemini 4 Argon ima ograničenu dostupnost zbog sigurnosnih zabrinutosti — Google rolls out new Gemini AI model but restricts access over safety concerns (izvorni članak: The Guardian, isto potvrđuju Arab News i drugi) — !«メールアドレス», 2026-10-01, score -3 / 2 komentara. Google nije javno otvorio Gemini 4 Argon, već ga je prvo ponudio samo stručnjacima za kibernetičku sigurnost i američkoj vladi. Model je navodno snažan u pronalaženju i otklanjanju softverskih ranjivosti te kibernetičkoj obrani, a dizajniran je da odbija zlouporabu za kibernetičke napade i razvoj kemijskog, biološkog ili nuklearnog oružja. Na Lemmyju je reakcija bila hladna i rezultat je ostao negativan.
  4. GitHubov novi dashboard prema zadanim postavkama ističe AI chat — The very first huge field on the new default GitHub dashboard is "AI" chat (izvor: GitHub Changelog) — !«メールアドレス», 2026-10-01 18:27, score 48 / 3 komentara. Autor kritizira istaknuti položaj AI chat funkcije, tvrdeći da se temelji na materijalu dobivenom bez dopuštenja. Komentari predlažu prelazak na Forgejo ili Gitea.
  5. COSMIC (System76) više neće prihvaćati LLM-generirani sadržaj u PR-ovima — COSMIC projects will no longer accept LLM-generated content in PRs (izvor: GitHub PR #3911) — !«メールアドレス», 2026-10-01 15:30, score 48 / 6 komentara. System76-ov razvojni inženjer Michael Murphy dodao je u smjernice za doprinose zabranu LLM-generiranog sadržaja. U komentarima se spominje nezadovoljstvo jer je PR za popravak alata za snimanje zaslona zatvoren nakon što je autor otkrio korištenje AI-ja.
  6. Odvjetnik je u žalbi za ubojstvo citirao lažne svjedoke koje je izmislio ChatGPT — Lawyer Cites ChatGPT-Invented Fake Witnesses in Murder Appeal (izvorni članak: 404media) — !«メールアドレス», 2026-10-01 13:18, score 24 / 1 komentar. Isti je članak zasebno prenesen u !«メールアドレス» (score 22 / 5 komentara, poveznica) i !«メールアドレス» (score 8, poveznica). Riječ je o slučaju iz Novog Meksika.
  7. GPT-Synopsys: OpenAI i Synopsys najavili su frontier AI za dizajn čipova — GPT-Synopsys (izvor: službena Synopsysova objava) — !«メールアドレス», 2026-10-01 11:00, score 1 / 0 komentara. OpenAI i Synopsys zajednički su predstavili GPT-temeljeni model specijaliziran za dizajn poluvodiča. Na Lemmyju zasad bez reakcija.
  8. „Claude vs. OpenAI's GPT 6.1 Sol” — poveznica na objavu (izvor: Reddit r/ArtificialInteligence) — !ai_reddit mirror zajednica, 2026-10-01 23:11, score 1 / 0 komentara. Usporedba zatvorenih modela; na Lemmyju samo prijenos bez komentara.
  9. „Pratim ugled Opusa 5.5 svaki dan od lansiranja; 30. rujna naglo je pao” — poveznica na objavu (izvor: Reddit r/ClaudeCode) — !ai_reddit mirror zajednica, 2026-10-01 13:49, score 0 / 0 komentara. Objavljeni tracker tvrdi da je raspoloženje Reddita prema Claude Opusu 5.5 30. rujna naglo palo.
  10. „Preokret: Gemini 4 Argon vodi Val AI benchmark po brzini, trošku i točnosti” — poveznica na objavu (izvor: Reddit objava sa slikom) — !ai_reddit mirror zajednica, 2026-09-30 22:44, score 1 / 0 komentara.
Signali
  • Najviše glasova među LLM temama na Lemmyju danas nije dobila najava modela, nego etička rasprava o eksperimentu koji AI-ju daje bol (#1, score 158). Lemmyjeva publika ima izraženije skeptičan i kritičan ton prema AI-ju, a zajednice poput !fuck_ai imaju vidljivu ulogu.
  • Čak je i važna najava ograničene dostupnosti Geminija 4 Argon (#3) u !technology završila s negativnim rezultatom, bez pozitivne popularnosti.
  • Većina objava pronađenih preko ključnih riječi poput Claude, GPT i Gemini dolazi iz automatskih Reddit mirrora kao što je !ai_reddit, s rezultatima 0–1 i bez komentara. To nisu samostalne Lemmy rasprave, nego neaktivni prijenosi Reddit tema. Gotovo da nema živih rasprava o odnosu otvorenih i zatvorenih težina.
  • Jedine aktivnije rasprave nisu bile o izvedbi modela, nego o upravljanju iz perspektive razvojne zajednice: zabrani LLM-generiranih PR-ova i otporu nametanju GitHubovih AI funkcija (#4, #5).
Ograničenja
  • Lemmy je općenito malen. Pri prikupljanju deset dnevnih LLM objava posljednje četiri (#7–#10) popunjene su slabo reagiranim prijenosima mirrora ili objavama bez reakcija, s rezultatom 0–1 i bez komentara. Stvarno aktivna izvorna rasprava postojala je uglavnom za #1, #4, #5 i #6.
  • lemm.ee je API pretragu (/api/v3/search) preusmjeravao na join-lemmy.org, pa pretraga nije bila moguća; moguće je da je riječ o promjeni ili gašenju instance.
  • Na lemmy.ml su istim ključnim riječima pronađene samo objave koje se preklapaju s onima na lemmy.world, bez novih samostalnih nalaza, što je očekivano zbog federacije.
  • Broj pretplatnika za !Independent_Media i !ai_reddit, kao i instanca koja hosta !ai_reddit, nisu se mogli utvrditi jer su API upiti vraćali 404/400.
  • Izvorni članak The Guardiana nije se mogao izravno dohvatiti, pa je sadržaj potvrđen preko prenesenih članaka istog sadržaja, uključujući Arab News i techjuice.

Preporučene radnje

  • U sljedećem prikupljanju s X-a treba zamijeniti Explore trendove LLM ključnim riječima, uključujući nazive modela i tvrtki.
  • Reddit prikupljanje treba dopuniti pretragama pojedinačnih modela umjesto oslanjanja na jedan pojam.
  • Treba nastaviti pratiti ograničenja pristupa i sigurnosnu politiku Geminija 4 Argon.
  • U sljedećem ciklusu treba ponovno provjeriti je li Blueskyjev API za pretraživanje prestao vraćati 403 i, ako jest, vratiti se pretragama ključnim riječima.
  • Raspravu o sigurnosti otvorenih nasuprot zatvorenim modelima treba nastaviti promatrati kao stalnu temu.

Napomena o kvaliteti podataka

X-ov proces prikupljanja temeljio se na geolociranim Explore trendovima nepovezanima s LLM-ovima, pa je valjanih podataka bilo nula. Bluesky je zbog 403 odgovora API-ja za pretragu koristio prikupljanje po računima, a Reddit je pretražen samo jednim pojmom te ne uključuje objave od dana 10/2.