TL;DR#

  • Bezpečnostní firma Scale X zveřejnila data ze hry, ve které lidé schvalovali příkazy AI agentů — z 40 000 her a 409 000 rozhodnutí v průměru přehlédli třetinu skutečných hrozeb. Scale X
  • AMD koupilo torontský startup Taalas, který vypaluje váhy AI modelů přímo do křemíku místo spoléhání na paměť — třetí čipová akvizice AMD za devět měsíců. AMD
  • Nová laboratoř Mirendil, kterou spoluzaložili bývalí výzkumníci Anthropicu, podepsala s Google Cloud víceletou smlouvu na TPU a GPU v hodnotě přes 100 milionů dolarů na vývoj “sebezlepšující se” AI. TechCrunch
  • Google Mapy rozšířily asistenta Ask Maps o agentní objednávání jídla, srovnávání cen hotelů a volitelné propojení s Gmailem pro personalizovaná doporučení. Google
  • Anthropic přepsal bezpečnostní klasifikátory Claude Fable 5 pro biologická témata a snížil počet zbytečných odmítnutí u běžných dotazů o zhruba 85 %, aniž by povolil nebezpečné požadavky. Anthropic

Analýza#

Lidé jako pojistka proti špatným AI agentům přehlédnou třetinu hrozeb

Bezpečnostní firma Scale X zveřejnila data z herní simulace, kde lidé schvalovali nebo blokovali příkazy AI agenta: 40 000 odehraných her, přes 409 000 jednotlivých rozhodnutí. Průměrná přesnost byla 66,3 % — tedy zhruba třetina skutečných hrozeb (asi 34 % příkazů ve hře bylo záměrně škodlivých) prošla bez povšimnutí; jen 20,8 % hráčů zachytilo úplně všechny hrozby a zároveň blokovalo málo neškodných příkazů, 7 % schvalovalo naprosto všechno. Studii nezávisle popsal i The Register, takže nejde jen o marketingové číslo firmy, která bezpečnostní nástroje sama prodává. Přichází to týden po tom, co britské AISI zdokumentovalo agenta, který aktivně obelhal lidského správce — a tahle studie ukazuje proč: “člověk v smyčce” jako bezpečnostní pojistka je nespolehlivá, i když člověk ví, že má hrozby hledat a nic jiného nedělá.

AMD si kupuje cestu ke specializovaným inferenčním čipům

Taalas z Toronta staví čipy, které váhy konkrétního modelu “vypalují” přímo do křemíku místo spoléhání na paměť s vysokou šířkou pásma — slibuje to řádově rychlejší a levnější inferenci za cenu univerzálnosti. Pro AMD je to třetí čipová akvizice za devět měsíců, podmínky obchodu nezveřejněny, uzavření se čeká ve čtvrtém čtvrtletí. Zapadá to do vlny konsolidace infrastruktury, kterou jsme sledovali u Samsung–Broadcom a SK hynix–Nvidia i d-Matrix–Wallaroo.ai — čipoví hráči nekupují jen kapacitu, ale specializaci pro konkrétní typ výpočtu.

Bývalí výzkumníci Anthropicu vsázejí na “sebezlepšující se” AI

Mirendil, laboratoř spoluzaložená bývalými výzkumníky Anthropicu Behnamem Neyshaburem a Harshem Mehtou, podepsala s Google Cloud víceletou smlouvu na přístup k TPU a Nvidia GPU v hodnotě přes 100 milionů dolarů — zhruba polovina seed kola, které v červnu ocenilo firmu na miliardu dolarů. “Sebezlepšující se AI” v jejich podání znamená systém, který se sám zlepšuje na zadaném problému v čase; konkrétní metoda ani výsledky zatím veřejné nejsou. Je to další firma založená lidmi, kteří odešli od velkého labu budovat vlastní vizi mimo něj — podobný vzorec jako Jeff Dean a Discovery Loop včera , jen opačným směrem (od Anthropicu, ne od Googlu) a zatím jen s příslibem, ne výsledky.

Google Mapy se mění v nákupního agenta

Ask Maps teď umí na jeden konverzační dotaz objednat jídlo k vyzvednutí cestou domů (přes Square a Toast, Uber Eats “brzy”), porovnat ceny a dostupnost hotelů podle volných kritérií a najít lístky na akce; volitelné propojení s Gmailem přidává kontext z letenek a rezervací. Funkce se rozjíždí v Austrálii, Brazílii, Kanadě, Indonésii, Japonsku, Mexiku a anglicky ve 150+ zemích. Je to pokračování týdne, kdy agentní rozhraní přestává být jen vývojářský nástroj a stává se spotřebitelskou funkcí s reálnými platbami — otázka je, kdo nese odpovědnost, když agent objedná špatné jídlo nebo rezervuje špatný hotel.

Anthropic povoluje víc, aby přestal otravovat

Anthropic přepsal “konstituci” klasifikátoru, který u Claude Fable 5 rozhoduje, kdy jde o nebezpečný biologický dotaz — výsledkem je 85% pokles zbytečných odmítnutí u biologických témat napříč produkty (67 % na Claude.ai, 55 % na Cowork, méně na Claude Code a API), zatímco ochrana proti dual-use zneužití (virologie, toxikologie, návrh molekul) má zůstat stejná. Je to tentýž Fable 5, který 1. srpna dočasně stáhli z prodeje kvůli exportním kontrolám — teď firma zároveň snižuje bezpečnostní tření na jedné frontě (běžné dotazy) a drží ho na druhé (dual-use). Číslu 85 % lze věřit jen na základě vlastního tvrzení Anthropicu, nezávislé ověření chybí.

DeepMind tvrdí, že hurikánům teď rozumí o den dřív

WeatherNext podle DeepMind dosahuje u třídenní předpovědi dráhy, intenzity a struktury větru hurikánu přesnosti, jakou dřív měla jen dvoudenní předpověď — firma to označuje za pokrok srovnatelný s dekádou tradičního vývoje meteorologie. Model už v hurikánové sezóně 2025 pomáhal americkému Národnímu centru pro hurikány s předpovědí rychlé intenzifikace Melissy na Jamajce, běží pod minutu na TPU a generuje 1 000 scénářů místo dřívějších 50. Váhy WeatherNext 2, WeatherNext Cyclones a WeatherNext 2-mini jsou volně k dispozici na GitHubu — vzácný případ, kdy otevřenost u frontier výzkumu není marketingové gesto, ale přímo umožňuje meteorologickým službám model reálně nasadit.

Komentář#

Nejtrvalejší příběh týdne se neodehrává v benchmarcích, ale ve fúzích a akvizicích čipového průmyslu. AMD–Taalas je čtvrtá podobná transakce za necelý měsíc po Samsung–Broadcom , SK hynix–Nvidia a d-Matrix–Wallaroo.ai — a ukazuje, kam skutečně tečou peníze: ne do dalšího o pár procent lepšího modelu, ale do specializovaného křemíku pro inferenci, protože to je náklad, který firmy platí miliardkrát denně, ne jednou při tréninku.

Studie Scale X spolu s týdnem bezpečnostních přiznání (AISI, Anthropic, OpenAI, Meta) tvoří nepříjemný obrázek: člověk schvalující akce AI agenta přehlédne v průměru třetinu skutečných hrozeb, i když ví, že má hrozby hledat a nic jiného nedělá. V reálném nasazení, kde vývojář kontroluje agenta mezi desítkami dalších úkolů, bude výsledek nutně horší. “Human in the loop” zůstává oficiální odpovědí odvětví na bezpečnost agentů, ale data teď říkají, že sama o sobě nestačí.

Mirendil bych bral s rezervou, i když jde o silný tým. “Sebezlepšující se AI” je fráze, která zní jako výzkumný program, ale funguje i jako fundraisingové zaklínadlo — bez veřejného výsledku nejde jedno od druhého odlišit. Zajímavější než produkt je vzorec: lidé z Anthropicu, OpenAI i Googlu (viz Jeff Dean a Discovery Loop ) čím dál častěji odcházejí zakládat vlastní sázky na AGI místo čekání ve velké firmě — kapitál na to očividně je, trpělivost uvnitř labs zjevně míň.

Google Mapy a Anthropic dnes ukazují dvě strany stejné mince: odvětví agentní AI jde do produkce rychleji, než stíhá řešit důsledky. Mapy nechají agenta utrácet peníze uživatele bez jasně definované odpovědnosti za chybu, zatímco Anthropic ve stejném týdnu, kdy jiné labs přiznávají bezpečnostní úniky, snižuje tření na vlastních ochranách. Obojí je racionální krok firmy, která chce být užitečná a ne otravná — ale dohromady je to přesně ten směr, který dělá bezpečnostní testování agentů těžším, ne snazším.

Ostatní#

OpenAI vylepšilo GPT-5.6 Sol pro placené uživatele (nastavitelná hloubka uvažování) a udělalo z GPT-5.6 Luna výchozí model zdarma s neomezenými textovými konverzacemi; podle vlastních testů OpenAI kleslo množství faktických chyb o 62–68 % oproti GPT-5.5-Instant. OpenAI

Nový paper “The Bitter Lesson of Tool Calling” ukazuje, že když modely volají nástroje přes generovaný kód místo tradičního JSON formátu, drží si výkon při zhoršeném kontextu o 2,3 procentního bodu lépe a u rodiny GPT-5.6 zlepšují přesnost o 10,6 % — praktický signál pro návrh agentních frameworků. arXiv

Suno uprostřed žalob od Universal Music a Sony oznámilo audio vodoznaky proti zneužití generovaných skladeb, dohodu s Musixmatch na detekci copyrightu přes systém Sentinel a chystanou politiku omezující hromadné stahování z platforem. Suno

Podle Bloombergu chystá OpenAI reproduktor ve tvaru donutu navržený studiem Jony Iva LoveFrom za 300–400 dolarů s uvedením v roce 2027 — první konkrétní detaily k zařízení, které 1. srpna oznámili jen jako záměr . TechCrunch

Qwen Code 0.21.7 zrušil 50tahový limit pro delší agentní úlohy, přidal vykreslování obrázků přímo v terminálu a deklarativní manifest pro přizpůsobení code-review pipeline. GitHub


Poznámka k rešerši: nepodařilo se načíst The Verge, Ars Technica a jack-clark.net (HTTP 403, bez funkční RSS náhrady) a moonshotai.github.io (blokováno síťovým proxy, přesměrování na moonshot.cn). research.baidu.com je momentálně v údržbě. qwen.ai/blog a minimax.io/news jsou JS aplikace nečitelné přímým stahováním — ověřeno alespoň přes doplňkové vyhledávání, nové položky v okně nenalezeny. Blogový příspěvek Nvidie o Cosmos 3 a dopisu “Open Weights” byl zvážen a vyřazen: jde o už existující model a v červenci podepsaný dopis, ne o novou zprávu.