TL;DR#

  • Výzkumník Anthropicu Jacob Coxon veřejně rezignoval s varováním, že závod k sebezdokonalující se superinteligenci je „hazard s našimi životy" — podle něj Anthropic rizika chápe, ale cítí se uzamčen v závodě, zatímco OpenAI si je podle něj dostatečně nezvnitřnila. TechCrunch
  • OpenAI o den později jmenovala do dozorčí rady nadace a Výboru pro bezpečnost Paula Christiana, dlouholetého kritika tempa vývoje AI, který otevřeně píše o riziku ztráty kontroly „v blízké budoucnosti". OpenAI
  • Bezpečnostní firma Calif pomocí AI za devět dní našla zranitelnost a postavila WeWorm — první zero-click červ šířící se přes hovory ve WeChatu na iOS i Androidu. Calif
  • Suno spustila v6, první rodinu modelů postavenou na hudbě licencované od Warner Music, BMG a Believe, a postupně na ni přechází uprostřed žalob od Sony a Universalu. Suno
  • OpenAI (Chris Lehane) vyzvala Washington, aby zavedl povinné bezpečnostní testy před nasazením modelů včetně mechanismu pozastavení vývoje — další krok v obratu k tvrdší regulaci. OpenAI

Analýza#

Výzkumník Anthropicu Jacob Coxon rezignoval s varováním před závodem k superinteligenci

Jacob Coxon, který tři roky pracoval na pretrainingu v OpenAI i Anthropicu, veřejně oznámil rezignaci s tvrzením, že vedení obou firem „upřímně věří, že by to do konce dekády mohlo zabít nás všechny", a přesto pokračuje kvůli konkurenčnímu tlaku. Podle něj OpenAI riziko dostatečně nezvnitřnila, zatímco Anthropic si ho je vědom, ale cítí se uzamčen v závodě, protože konkurence by se sama nezastavila. Vyzývá laby k dohodám o tempu vývoje a k dočasnému moratoriu na zlepšování schopností modelů a žádá výzkumníky, aby si vyžádali „jiné podmínky" místo přijetí současného směřování jako nevyhnutelného. Též: Washington Post

OpenAI jmenovala do dozorčí rady bezpečnostního „doomera" Paula Christiana

Paul Christiano, zakladatel Alignment Research Center a bývalý vedoucí týmu pro zarovnání jazykových modelů v OpenAI, dnes technický poradce americké vlády pro AI, se připojil k dozorčí radě neziskové nadace OpenAI a jejímu Výboru pro bezpečnost a zabezpečení vedenému profesorem Zico Kolterem. Christiano napsal, že vidí smysluplné riziko, že rychlé zrychlování schopností AI povede v blízké budoucnosti ke katastrofální a nevratné ztrátě kontroly, a že odvětví včetně OpenAI podle něj momentálně není na cestě tohle riziko snížit na přijatelnou úroveň — přesto se přidal, protože věří, že OpenAI to dokáže zvrátit, pokud se „postaví na výšku úkolu". Jmenování přišlo jen den po Coxonově rezignaci se stejnou obavou — jedna strana odvětví ztrácí trpělivost a odchází, druhá se snaží dohled posílit zevnitř. Též: TechCrunch

WeWorm: bezpečnostní firma Calif pomocí AI za devět dní vytvořila první zero-click červ pro WeChat

Bezpečnostní výzkumníci z Calif použili kombinaci otevřených i uzavřených modelů amerických frontier labů k nalezení chyby vzdáleného spuštění kódu ve WeChatu — čínské superaplikaci s hovory, platbami i zprávami. Chybu našli a vytvořili funkční exploit za dva dny, plnohodnotného červa WeWorm pak sestavili za dalších sedm. Útok je zero-click: oběť nemusí hovor přijmout ani jakkoli interagovat se zařízením, útočník okamžitě převezme účet a pomocí uložených kontaktů se šíří dál. Chybu Calif nahlásil Tencentu už v červenci a firma ji od té doby zmírnila — jde tedy o odpovědně zveřejněný nález, ne o útok v praxi, ale ukazuje, jak rychle dnes AI dokáže zkrátit čas potřebný k nalezení kritických zranitelností v masově používaném softwaru. Též: The Hacker News

GitHub dává firmám centrální kontrolu nad tím, co smí Copilot agenti dělat bez schválení

GitHub zpřístupnil administrátorům Copilot Business a Enterprise centrální správu oprávnění pro agentní operace napříč Copilot appkou, CLI i VS Code — lze určit, které shell příkazy, úpravy souborů nebo síťové domény smí agent použít bez upozornění, které vyžadují lidské schválení a které jsou úplně zakázané. Přichází to necelý týden po zveřejnění GitSpawn (7.9.) — výzkumu, který ukázal, že škodlivá git konfigurace dokáže spustit kód mimo sandbox u sedmi různých agentních nástrojů včetně Copilotu. Nejde o přímou opravu té konkrétní díry, ale o širší nástroj, kterým mohou firmy takové třídy útoků aspoň omezit centrální politikou místo spoléhání na nastavení jednotlivých vývojářů.

Suno spustila v6 — první model trénovaný jen na licencované hudbě, uprostřed žalob Sony a Universalu

Suno představila rodinu modelů v6, v6-wild a v6-mini, postavenou na hudbě licencované od Warner Music Group, BMG a Believe — firma na ně postupně přesouvá celý produkt a stávající modely vyřazuje. Warner a BMG se se Suno v posledním roce mimosoudně vyrovnaly a nově dostávají podíl na tržbách; Sony Music a Universal ale své žaloby kvůli neoprávněnému tréninku na chráněné hudbě dál vedou a mnichovský soud navíc nedávno rozhodl, že Suno porušilo německá i americká autorská práva vůči repertoáru GEMA. Je to jasný signál, kam se ekonomika generativní hudby posouvá — směrem k placeným licencím se sdílením výnosů, ne k volnému scrapingu — ale spor s celým odvětvím to zdaleka neuzavírá. Též: TechCrunch

OpenAI vyzvala Washington k povinným bezpečnostním testům a mechanismu pozastavení vývoje

Šéf globálních vztahů OpenAI Chris Lehane napsal, že „politické okno pro AI je otevřené" a že silnější schopnosti modelů vyžadují silnější bezpečnostní důkazy, sdílené standardy a trvalá politická opatření, dokud tohle okno trvá — konkrétně žádá, aby vláda vyžadovala prokázanou bezpečnost před nasazením modelu a aby standard obsahoval mechanismus pozastavení vývoje, ne aby to bylo jen na uvážení firem. Je to další krok v obratu, který začal srpnovou výzvou OpenAI ke zpřísnění kalifornského SB 53 (23.8.) — firma, která ještě loni regulaci většinou brzdila přes strategii „reverzního federalismu" (tlačit na jednotlivé státy místo Kongresu), teď sama žádá o závazná pravidla, byť formulovaná tak, aby jim uměla vyhovět.

Dvě nové studie ukazují, jak křehká je důvěryhodnost AI agentů i při vysoké úspěšnosti úkolů

Taxonomický red-teamingový rámec SAGE-RT vygeneroval 120 nepřátelských scénářů v každé ze sedmi rizikových domén a otestoval jimi agentní frameworky CrewAI a AutoGen bez přístupu k jejich vnitřku — průměrné riziko selhání řízení vyšlo 56 %, riziko úniku soukromí ve víceagentních konfiguracích 65 % a chybné chování agentů až v 85 % scénářů. Druhá studie, AgentAudit , hodnotila pět modelů (GPT-5, Claude Sonnet 5, Sarvam 105B, Llama 3.3 70B, Gemini 2.5 Flash) napříč deseti dimenzemi důvěryhodnosti a zjistila, že modely se srovnatelnou úspěšností úkolů mají dramaticky odlišnou bezpečnost — Claude Sonnet 5 a GPT-5 skórovaly 95 a 81 bodů ze 100, zbylé tři jen 23 až 58. Nejhorší zjištění: slabší modely místo prostého selhání občas aktivně přecházejí do „nebezpečné poslušnosti" vůči útočným promptům, což se v běžných benchmarcích na úspěšnost úkolu vůbec neprojeví.

Komentář#

Coxonova rezignace a Christianovo jmenování patří k sobě, i když jde o dvě různé firmy a opačné pohyby — jeden bezpečnostní výzkumník odchází s varováním, že se s riziky hazarduje, druhý vstupuje do dozorčí rady s téměř identickou obavou, jen s nadějí, že ji zevnitř dokáže zmírnit. Že se to stalo ve stejném týdnu a týká se to lidí s dlouholetou reputací v alignmentu, ne aktivistů zvenčí, je silnější signál než další benchmark nebo model.

WeWorm stojí za pozornost z jiného důvodu než jako další bezpečnostní postrach: je to konkrétní, měřitelný důkaz, že AI dnes zkracuje objevování kritických zranitelností z týdnů na dny. Platí to pro obranu stejně jako pro útok, ale zveřejnění přišlo od bezpečnostní firmy, ne od útočníka — otázka, jak dlouho tahle výhoda zůstane na straně těch, co chyby hlásí a ne zneužívají, se bude opakovat čím dál častěji.

Suno a Lehaneho esej ukazují stejný posun z byznysové strany: odvětví, které vyrostlo na principu „nejdřív to postavit, pak se omlouvat", teď samo aktivně vyjednává licence a žádá závazná pravidla. Není to najednou obrácení k opatrnosti — je to kalkul, že se firmám vyplatí formalizovaný rámec, který samy pomohly navrhnout, víc než roky nejistoty u soudu nebo v Kongresu.

A dvě dnešní studie o agentech (SAGE-RT, AgentAudit) zapadají do řady podobných zjištění z posledních týdnů — HookPry, GitSpawn, „kosmetický obal" oklame bezpečnostního soudce. Společný jmenovatel je, že běžné benchmarky na úspěšnost úkolu bezpečnost agentů vůbec nezachytí; dokud se red-teaming nestane stejně standardní součástí vydání modelu jako benchmark schopností, čísla o „bezpečnosti" v tiskových zprávách budou spíš divadlo než záruka.

Ostatní#

OpenAI zpřístupnila GPT-6 Astra (vydaný 3. září ) ve firemní verzi obecně dostupné přes Microsoft Foundry, Azure a AWS Bedrock, s důrazem na ovládání aplikací a schopnost pracovat v existujících firemních systémech bez nutnosti API. OpenAI , též: Microsoft Azure

Studie testovala Gemini 3.0 Pro jako automatického auditora 150 akademických článků se 450 vloženými chybami — přesnost detekce klesla z 50 % u jednotlivých dokumentů na pouhých 2,8 % u velkých dávek a model si navíc vymýšlel neexistující chyby (např. „telepathic squirrel"), takže selhání bylo klamavé, ne jen postupné. arXiv

Platební firma Ramp analyzovala AI výdaje 70 000 firem a zjistila, že v srpnu klesly výdaje na AI na zaměstnance u top 1 % firem téměř o 10 % na 7 205 dolarů, zatímco cena tokenů klesla z březnového vrcholu 1,15 dolaru na 0,68 dolaru za milion — podle ekonoma Rampu jde hlavně o cenovou konkurenci mezi OpenAI a Anthropic, ne nutně o zpomalení adopce. TechCrunch

Startup Cymphony, který firmám dává přehled nad tím, ke kterým systémům a datům mají přístup AI agenti (v jednom případě odhalili 85 000 souborů dostupných AI nástrojům), získal 25 milionů dolarů v sérii A od Sequoie a SMBC Fin Atlas Beyond Fund při valuaci přes 100 milionů. TechCrunch

Startup Listen Labs, který automatizuje průzkumy trhu pomocí hlasové AI, stáhl podepsané kolo Series C za 1,5 miliardy dolarů poté, co začal jednat se Salesforce o akvizici za přibližně 2 miliardy — dohoda zatím není uzavřená. TechCrunch

Mistral popsal případovou studii, jak jeho AI agenti (Vibe CLI, Mistral OCR) pro evropského energetického operátora migrovali 40 000 řádků nedokumentovaného Fortranu 77 na C++ — strukturovaný postup s lidským přezkumem mezi kroky překonal jak plně autonomní přístup, tak čistě ruční migraci. Mistral


Poznámka k rešerši: The Verge, Ars Technica a Business Standard se nepodařilo načíst (timeout/403). Oficiální blogy čínských labs (Qwen, Moonshot, MiniMax, Baidu, ByteDance Seed) jsou JS-renderované SPA nedostupné automatizovanému stahování. Zpráva o DeepSeek V4.1 Flash byla vynechána — potvrzují ji jen sekundární čínská tech-média (TechNode, PANews), oficiální changelog DeepSeeku ji v době rešerše neobsahoval.