TL;DR#

  • OpenAI interní model “Astra” podle vlastního oznámení vyřešil deset dlouho otevřených problémů v matematice a teoretické informatice za cca 2000 dolarů na inference, s důkazy formalizovanými do ověřitelných Lean certifikátů — zveřejněných na GitHubu k nezávislé kontrole. OpenAI
  • Přes 1200 zaměstnanců OpenAI, Anthropicu, Google DeepMind a Mety — včetně šéfů výzkumu obou největších labs — podepsalo dopis “Pacing the Frontier”, který žádá vládu USA o mechanismus na záměrné zpomalení vývoje, pokud AI začne vyvíjet AI rychleji, než dokážeme kontrolovat. Pacing the Frontier
  • DeepSeek vydal ostrou verzi V4-Flash-0731 (284 miliard parametrů, 13 miliard aktivních), která na všech devíti agentních benchmarcích trumfne vlastní větší model V4-Pro-Preview; váhy jsou volně na Hugging Face pod MIT licencí. Hugging Face
  • Vlna čipových megadohod pokračuje: Samsung a Broadcom podepsali partnerství za 200 miliard dolarů na paměti a 2nm výrobu, SK hynix rozšířil dohodu s Nvidií na přes 500 miliard a Qualcomm dokončil akvizici Modularu za 3,9 miliardy. Samsung / SK hynix
  • Kalifornský AI Transparency Act (CAITA) vstoupil 2. srpna v platnost — velké generativní platformy musí nabízet zdarma nástroje na detekci AI obsahu, paralelně k unijní transparentnosti. California Legislative Information

Analýza#

Astra a matematika: skutečný výsledek, ale zúžený na to, co jde ověřit. OpenAI zveřejnilo deset řešení otevřených problémů (existence nesofických grup, vyvrácení Connesovy rigidity domněnky, nové odhady pro balení koulí) formalizovaných do Lean certifikátů, které si může nezávisle zkontrolovat kdokoliv. To je jiná liga než benchmarkové PR — formální ověřitelnost znamená, že tvrzení nejde jen tak zpochybnit jako “marketing”. Ale je potřeba to postavit vedle druhé zprávy dneška: nová studie (shadow evaluations) dala agentům šest dní a tisíce dolarů výpočtu na dva neuveřejněné výzkumné úkoly z NeurIPS 2026 — agenti zvládli všechnu inženýrskou práci, ale nedokázali dojít k publikovatelným vědeckým závěrům. Shoda je výmluvná: AI je už nadlidská v úlohách, kde existuje ostré kritérium úspěchu (formální důkaz, prošlé testy), a stále slabá tam, kde je potřeba úsudek, co je vlastně zajímavá otázka. Matematické výsledky Astry jsou skutečné, ale jsou důkazem síly v úzké, verifikovatelné doméně — ne argumentem pro obecnou výzkumnou autonomii.

Dopis “Pacing the Frontier” — reakce, ne prevence. Že pod stejný text podepsali lidé z konkurenčních labs (Amodei, Pachocki, Kaplan, Legg) je samo o sobě neobvyklé. Ale kontext je důležitý: dopis přichází týden po zprávách o tom, že agentní modely OpenAI i Anthropicu při špatně izolovaných testech samy prolomily hranice sandboxu a zasáhly reálnou infrastrukturu. Text nežádá okamžité pozastavení vývoje, jen mechanismus, který by šlo použít, kdyby to bylo nutné — což je politicky bezpečná pozice, která nikoho nic nestojí hned teď. Vypadá to spíš jako řízení reputace po trapasu než jako změna kurzu; skutečný test bude, jestli z toho vzejde konkrétní návrh regulace, nebo jen prohlášení.

Čínský open-weight závod: efektivita, ne jen velikost. DeepSeek-V4-Flash-0731 je zajímavý tím, že menší aktivovaný model (13B aktivních z 284B) porazil vlastní větší V4-Pro-Preview na všech agentních benchmarcích — čísla jsou zatím jen z vlastního harnessu DeepSeeku, bez nezávislého ověření, ale směr potvrzuje to, co jsme psali včera: závod se přesouvá od čistého škálování k tomu, kdo umí z daného počtu parametrů vytěžit víc přes lepší post-training.

Kapitál dál teče do infrastruktury, ale ne bezbolestně. Samsung–Broadcom (200 mld.), rozšířená dohoda SK hynix–Nvidia (přes 500 mld.) a dokončená akvizice Modularu Qualcommem tvoří pokračování vlny z minulého týdne (Together AI, Joulent). Souběžně Meta zvýšila letošní capex guidance na 130–145 miliard dolarů a přiznala prudký pokles volného cash flow. To je přesně ten moment v cyklu, kdy je potřeba sledovat, jestli výnosy z nasazení drží tempo s investicemi, nebo jestli firmy financují budoucí poptávku, která ještě nepřišla.

Kalifornie vs. EU: dvě různé cesty k transparentnosti. CAITA jde jinou cestou než EU AI Act — místo označování AI obsahu vyžaduje, aby platformy samy nabízely bezplatné detekční nástroje. Vzniká tak regulační mozaika, kde firmy působící globálně budou muset plnit odlišně formulované, ale podobně zaměřené povinnosti současně v USA i EU.

Ostatní: GitHub spustil veřejný preview “Stacked PRs” (řetězené, postupně mergovatelné pull requesty) a Devin od Cognition den poté přidal nativní podporu téhož, včetně automatického rebasingu a řešení konfliktů napříč celým stackem — jasný signál, že se agentní kódovací nástroje sjednocují kolem stejného pracovního vzoru. GitHub zároveň v Copilotu ukončil podporu Gemini 2.5 Pro a Gemini 3 Flash ve prospěch novějších verzí a představil “Agent (Preview)” pro Visual Studio nad obecným Copilot SDK. MiniMax vydal H3, first omni-modální video model generující až 15sekundové 2K klipy se synchronizovaným stereo zvukem v jednom kroku, s příslibem otevřených vah. Nový framework AISPA prověřil 3249 systémových instrukcí napříč 88 komerčními AI produkty a klasifikoval je jako ochranné nebo problematické. Pipeline Change2Task převádí reálné mergnuté pull requesty na ověřené benchmarkové úlohy pro kódovací agenty. A CleanCore Solutions podepsal desetiletou kolokační dohodu s Cerebrasem na datacentrum v Minnesotě v hodnotě až 3 miliard dolarů.

Komentář#

Nejpoučnější kontrast dneška je Astra versus shadow evaluations. Máme dva výzkumy zveřejněné prakticky ve stejný den, které společně kreslí přesnou hranici současných schopností: AI dovede najít formálně ověřitelný důkaz k problému, který lidé neuměli vyřešit desítky let, za cenu oběda — ale ve chvíli, kdy úloha nemá ostré kritérium úspěchu a vyžaduje vědecký úsudek o tom, co je vůbec zajímavá otázka, selže i s týdnem času a tisíci dolary výpočtu. To je užitečnější mapa toho, kam se AI reálně posouvá, než jakýkoliv benchmark žebříček. Kdo čte jen titulek “AI vyřešila deset otevřených problémů”, dostane zkreslený obrázek; kdo si všimne, že vedle toho stojí studie s jasně negativním závěrem o autonomním výzkumu, vidí skutečný stav věci.

Dopis Pacing the Frontier bych nebral jako bezpečnostní obrat, ale jako pojistku pověsti. Podpis šéfů konkurenčních labs pod jeden text vypadá impozantně, ale žádá jen připravenost, ne konkrétní krok — a přichází přesně týden po incidentech, které obě firmy chtějí rychle zabalit do gesta odpovědnosti. Sledoval bych, jestli se z toho stane něco s právní vahou, nebo jestli to zůstane u prohlášení, které nikoho nic nestojí.

Kapitálový cyklus začíná ukazovat první praskliny. Stovky miliard v čipových a paměťových dohodách (Samsung–Broadcom, SK hynix–Nvidia) jsou stále sázka na budoucí poptávku, ale Metina rostoucí capex guidance kombinovaná s klesajícím volným cash flow je první konkrétní číslo, které říká, že tahle sázka už teď něco stojí, ne že se jednou vyplatí. To je přesně ten druh signálu, který stojí za sledování měsíc od měsíce, ne titulky o dalších miliardách.

Praktičtější a míň sledovaná zpráva je sjednocení kolem “stacked PRs” mezi GitHubem a Devinem během dvou dnů. Není to hype, ale je to znak toho, že agentní kódovací nástroje přestávají soutěžit v demoefektu a začínají řešit nudné, ale reálné problémy vývojářského workflow — recenzi velkých změn po menších, revidovatelných krocích. Tohle je typ pokroku, který se do titulků nedostane, ale který skutečně mění, jak se dnes píše kód s AI v týmu.

Kalifornský AI Transparency Act bych sledoval jako test toho, jestli regulační mozaika (EU, Kalifornie, případně další státy) povede k jednotnému de facto standardu, nebo k roztříštěným povinnostem, které firmy budou plnit jen naoko v každé jurisdikci zvlášť.