TL;DR#

  • Google uvedl Gemini 4 Argon, který podle firmy předčí GPT-6 Astru i modely Anthropicu; zatím je ale jen pro vybrané obránce v programu Fairwind. Google
  • OpenAI oznámila, že narušila koordinovanou kampaň k extrakci chráněného uvažování svých modelů, a posiluje obranu proti distilaci. OpenAI
  • Newsom podepsal další kalifornské AI zákony: lidská kontrola automatizovaných pracovních rozhodnutí, transparentnost při AI propouštění, vodoznaky a deepfaky. Úřad guvernéra
  • Reddit kvůli AI botům ruší RSS feedy (13. 11. 2026) a veřejné API (březen 2027). TechCrunch
  • GitHub Copilot dostal v research preview HydraFusion, který v jednom kroku orchestruje více modelů (Single / Cascade / Critique). GitHub

Analýza#

Gemini 4 Argon: nejsilnější model Googlu, zatím jen pro obránce

Google uvádí 77,9 % na DeepSWE v1.1, 1.místo na Zapier AutomationBench (51,3 %) a remízu na prvním místě v CWE-bench v1 (68 %). Úvodní cena je 2/10 $ za milion tokenů, později 4/20 $. Přístup mají zatím jen „trusted cyber defenders" přes program Fairwind, širší dostupnost má přijít „brzy". TechCrunch dodává, že podle Googlu Argon překonává GPT-6 Astru i modely Fable a Opus a že vede index Vals (též: TechCrunch ). Všechna čísla pocházejí od Googlu. Důležitější než benchmark je model uvolňování: stejný vzorec „nejdřív obránci" jako u Gemini 3.8 Flash Cyber a Fairwind (3. 9.) — kybernetické schopnosti se stávají standardním důvodem k fázovému nasazení u všech tří velkých labů.

OpenAI: narušená kampaň k extrakci uvažování modelů

Podle krátkého popisu OpenAI „narušila kampaň k extrakci chráněného uvažování modelů" a posiluje obranu proti adversariální distilaci. Detaily jsem ze zdroje nezískal (stránka blokuje automatické stahování, vycházím z popisu v RSS), takže kdo za kampaní stál, tu nepíšeme. Téma navazuje na varování CISA/NSA/FBI k destilaci čínskými laby (9. 9.) a threat report Anthropicu (11. 9.) : ochrana „reasoning" stop je už běžná součást provozu labů, nejen jednorázová stížnost.

Kalifornie: další vlna AI zákonů

Newsom 30. 9. podepsal mj. SB 947 (lidská revize automatizovaných zaměstnaneckých rozhodnutí), SB 951 (transparentnost při AI-způsobeném hromadném propouštění), AB 2713 a SB 1000 (vodoznaky a metadata), SB 1111 (impersonace a deepfaky), SB 574 (právníci nesmí core práci plně delegovat na AI) a AB 1864 (bezpečnost syntézy genů). Tisková zpráva zmiňuje i dřívější SB 813 (rámec nezávislých ověřovacích organizací) a „Adam’s Law" (audity chatbotů pro děti). Pro firmy nejpraktičtější jsou pracovněprávní zákony; federální vakuum tak dál vyplňují státy, viz Newsomův kill-switch EO (20. 9.) .

Reddit ruší RSS a veřejné API

RSS feedy skončí 13. 11. 2026, veřejné API v březnu 2027, vývojáři musí do 12. 1. 2027 registrovat aplikace a boty. Reddit to zdůvodňuje zneužitím RSS k masivnímu scrapingu; TechCrunch připomíná, že „ostatní tržby" (hlavně AI licence) vzrostly meziročně o 24 % na 43 mil. $, takže finanční motiv je zjevný. Dopad: sociální poslech, výzkumné nástroje i AI asistenti čtoucí Reddit budou muset platit, nebo odpadnout.

GitHub HydraFusion: orchestrace modelů v jednom kroku

Research preview ve VS Code 1.140+ a v aplikaci Copilot pro tarify Pro, Pro+, Business a Enterprise. Na rozdíl od Auto (jeden model na požadavek) volí vzor Single, Cascade (levný model, při neprojití kontroly silnější) nebo Critique (druhý model draft posoudí). Je to oficiální potvrzení směru, který ukazují i papery, např. Mid-Harness : vzorkování kandidátních akcí s verifikátorem zvedlo Pass@1 na TerminalBench-Lite z 50,00 % na 68,03 % (verifikátor GPT-5.6 Sol, 8 vzorků). Kvalita verifikátoru je podle autorů zásadní — slabý verifikátor vzorkování nepomůže.

Komentář#

Cybersecurity se stává hlavním kanálem fázového uvolňování modelů. Google, OpenAI i Anthropic dnes nejdřív dávají nejsilnější verze obráncům a teprve potom ostatním. Pro vás to znamená: čekejte, že „nejlepší model" bude měsíce přístupný jen schváleným organizacím, a plánujte na modelu o generaci níž.

Druhý trend je orchestrace místo jediného modelu. HydraFusion i Mid-Harness říkají totéž: výhra není v dalším skoku velikosti, ale v tom, kdo dobře směruje, ověřuje a kritizuje. Sledujte tedy cenu za vyřešenou úlohu, ne za token — po Solu a Sonnetu 5.5 je to jediné srovnání, které něco říká.

Bublina? Benchmarkové souboje „nejsilnější model dne". Argon vede tabulky, které si Google vybral, a týden nato to bude jinak. Skutečný tlak jde z jiného směru: data se zavírají (Reddit), státy regulují místo Washingtonu (Kalifornie) a laby brání své uvažování před distilací. Přístup k datům a k modelům se stahuje do ohrad.

Ostatní#

ElevenLabs podle TechCrunche uzavřel employee tender offer za 300 mil. $ (vedli Wellington a T. Rowe Price) při valuaci 22 mld. $ — pokračování zprávy z 25. 9. , nové je jen to, že jde o sekundární prodej zaměstnanců. TechCrunch

Microsoft Research popsal ML systém, který předpovídá poškození elektrických sítí vesmírným počasím 30–60 minut předem. Microsoft Research

Qwen zveřejnil FlashQLA, knihovnu kernelů pro lineární attention v TileLang; udává 2–3× rychlejší forward průchod. GitHub

Moonshot vydal Kimi Code CLI, terminálového coding agenta (MCP, subagenti), který nahrazuje archivovaný kimi-cli. GitHub


Poznámka k rešerši: The Verge, Ars Technica a Business Standard (i RSS) nešly načíst; qwen.ai, MiniMax, DeepSeek news, Baidu a ByteDance Seed nevrátily čitelný obsah; washingtontimes.com a cnbc.com blokuje síťový proxy. Kvůli tomu jsem vynechal zprávy o dobrovolném závazku šéfů tech firem s Trumpem (30. 9.) a o údajném nařízení „Era of Super Intelligence" — nemám ověřený zdroj. Údaje o OpenAI distilaci vycházejí jen z popisu v RSS (stránka vrací 403). Google/DeepMind a Meta blog neměly ověřitelně datované nové příspěvky. Prompt injection jsem nezaznamenal.