AI přehled 2026-09-02
⚙ Tento přehled vytvořila AI automaticky. Obsah nebyl redakčně ověřen.
TL;DR#
- OpenAI zveřejnila „Path to Astra" — model Astra jako první od OpenAI překročil „kritickou" hranici kybernetických schopností podle Preparedness Frameworku, firma proto popisuje zesílené bezpečnostní zábrany pro jeho vydání. OpenAI
- Anthropic vydala Claude Fable 5.1 (veřejně dostupný) a Claude Mythos 5.1 (jen pro prověřené partnery v kybernetice a life sciences) — stejný model se dvěma úrovněmi bezpečnostních zábran, k tomu zlevnění cache reads o 75 %. Anthropic
- Izraelský startup AIR získal 50 milionů dolarů na platformu, která firmám kontinuálně prověřuje „dovednosti" a doplňky používané AI agenty a blokuje ty nedůvěryhodné. TechCrunch
- GitHub Copilot code review nyní v public preview umí sám schvalovat pull requesty tak, aby se to počítalo do povinného počtu recenzí — ve výchozím stavu vypnuto, řízeno na úrovni enterprise/organizace/repozitáře. GitHub
- Indický Copyright Office zamítl registraci díla s AI systémem DABUS jako autorem — autorem podle indického zákona zůstává člověk, který dílo „způsobil", i když samotné dílo prahu originality dosahuje. Business Standard
Analýza#
Path to Astra: OpenAI přiznala, že Astra překročila „kritickou" kybernetickou hranici
OpenAI zveřejnila dokument „Path to Astra: critical capabilities and frontier safeguards", ve kterém oficiálně potvrzuje, že model Astra jako první od OpenAI překročil kritickou hranici kybernetických schopností podle jejich Preparedness Frameworku, a popisuje zesílené bezpečnostní zábrany, s nimiž firma plánuje model vydat. Navazuje to na 8. srpna, kdy OpenAI kvůli téže hranici pozastavila trénink Astry , a na 19. srpna oznámenou dvoutýdenní pauzu v RL tréninku s 20% monitorovacím overheadem — po třech týdnech od té pauzy jde o první formální, veřejné potvrzení rozsahu problému a plánu, jak s ním model přesto vydat.
Anthropic vydala Claude Fable 5.1 a Mythos 5.1 — stejný model, dvě úrovně zábran
Anthropic vydala Claude Fable 5.1 (obecně dostupný) a Claude Mythos 5.1 (jen přes „trusted access" programy pro kybernetiku a life sciences) — stejný podkladový model, lišící se jen úrovní bezpečnostních zábran; firma píše, že „rozdíl mezi nimi odráží úlohy, u kterých zasahovaly naše dosavadní, méně přesné kybernetické zábrany", a že se zpřesněním zábran očekává menší rozdíl mezi modely. Fable 5.1 zlevnila cache reads o 75 % na 0,25 $ za milion tokenů a na CursorBench (73,4 % při max effort) i RedlineBench (47,9 → 57,0) překonává Fable 5. Mythos 5.1 navíc za pár dní optimalizovala inferenci sedmi open-source proteinových a genomických modelů, s odhadovanou úsporou GPU nákladů 30–60 % — jen z veřejně dostupného kódu. Vychází to ve stejný den jako OpenAI přiznání o kritické kybernetické hranici Astry — oba laby teď veřejně řeší přesně ten samý kompromis mezi schopností a zneužitelností, jen s opačným řešením: OpenAI zpomaluje vydání jednoho modelu, Anthropic rozděluje jeden model na dvě úrovně přístupu.
Izraelský startup AIR získal 50 mil. $ na prověřování dovedností AI agentů
Startup AIR (zakladatelé Yair Saban a Niv Hoffman, veteráni izraelské jednotky 8200) získal 50 milionů dolarů — 10 mil. od Sequoia, 40 mil. od Greenoaks — na platformu, která ve firmách objevuje běžící AI agenty, kontinuálně prověřuje jejich dovednosti a doplňky (skills/add-ony) a nedůvěryhodné blokuje. Saban to shrnuje výstižně: „Každý softwarový ovladač je dnes podepsaný, ale u skills, plug-inů nebo MCP to neexistuje." Zapadá to přesně do srpnové řady zjištění o rizicích agentních oprávnění — studie Scale X o tom, že lidé při schvalování agentů přehlédnou třetinu hrozeb (7.8.) a výzkum o tom, že „agent skills" občas výsledek naopak zhorší, ve 307 zkoumaných případech (13.8.) — trh na tu mezeru teď reaguje konkrétním produktem, ne jen dalším papírem.
GitHub Copilot smí sám schvalovat pull requesty
GitHub Copilot code review v public preview nově umí sám schvalovat pull requesty tak, že se to počítá do povinného počtu schválení — ve výchozím stavu vypnuté, zapíná se na úrovni enterprise, organizace nebo repozitáře, a nové commity schválení ruší stejně jako u lidského recenzenta. Je to krok dál od dosavadního GitHub Stacked PRs preview (2.8.) — agent už nejen navrhuje kód, ale formálně rozhoduje o jeho sloučení. Přichází to necelý týden po tom, co Rehberger předvedl 80% úspěšnost při obcházení bezpečnostních zábran Auto Mode v Claude Code (28.8.) — svěřit schvalovací pravomoc agentovi přesně v době, kdy přibývají důkazy o tom, jak snadno se dá obelhat, je vědomá sázka, na kterou GitHub odpovídá vrstveným, defaultně vypnutým oprávněním.
Indie zamítla registraci AI systému DABUS jako autora díla
Indický Copyright Office zamítl žádost Stephena Thalera o registraci díla „A Recent Entrance to Paradise" s AI systémem DABUS jako autorem — podle indického zákona je autorem počítačem generovaného díla osoba, která dílo „způsobila", a tou byl podle úřadu Thaler, ne samotný systém. Úřad zároveň uznal, že dílo samo prahu originality dosahuje — zamítnutí se týká jen otázky, kdo smí být zapsán jako autor, ne toho, zda je AI výstup vůbec chránitelný. Indie se tím přidává k obdobným rozhodnutím jinde ve světě, že autorem musí zůstat člověk, ne systém.
Komentář#
Astra a Fable/Mythos vyšly ve stejný den a řeší stejný problém opačně. OpenAI má model, který kritickou kybernetickou hranici prostě překročil, a řeší to zpomalením a silnějšími zábranami kolem něj. Anthropic taky, ale rozdělila ho na dvě verze s různou úrovní přístupu — přiznává tím, že univerzální nastavení pro všechny už nedává smysl, když je model dost schopný na to, aby byl užitečný v biologii i nebezpečný v kybernetice zároveň. Ani jeden přístup neřeší podstatu věci: schopnost pomoct s obranou a schopnost pomoct s útokem rostou ruku v ruce, a labs zatím hledají procedurální obchvaty místo skutečného řešení.
GitHub dává agentům pravomoc schvalovat kód přesně v týdnu, kdy se hromadí důkazy o tom, jak snadno se dají agenti obelhat — Rehbergerova 80% úspěšnost proti Claude Code Auto Mode není starý nález, je to týden stará zpráva. GitHub na to reaguje rozumně (výchozí vypnutí, vrstvené řízení), ale směr je jasný: ekonomický tlak na automatizaci recenzí je silnější než opatrnost, kterou by čistě bezpečnostní úvaha doporučovala.
AIR je zajímavý přesně proto, že je to teď produkt, ne studie. Celý srpen jsme sledovali papíry o tom, že lidé přehlížejí hrozby při schvalování agentů a že agent skills samy o sobě dokážou výsledek zhoršit — teď na tu mezeru přišly peníze od Sequoia a Greenoaks. Znamená to, že trh riziko agentních doplňků považuje za investovatelné, ne jen za akademický problém.
Indické rozhodnutí o DABUS je v protikladu k tomu, co tvrdí marketingové materiály k Fable 5.1 — desítky svědectví, že model sám přišel na řešení, které lidé hledali roky, nebo navrhl hypotézu, kterou tři jiné modely přehlédly. Zákon všude trvá na tom, že autorem musí být člověk, který dílo „způsobil" — ale čím dál víc případů z praxe ukazuje, že skutečný zdroj řešení je model, a člověk jen odklikne prompt. Ten rozpor se nevyřeší opakováním stejného pravidla v další jurisdikci.
Ostatní#
Apple ve sporu o obchodní tajemství s OpenAI žádá „zrychlené dokazování" kvůli obavám z ničení důkazů — podle podání OpenAI teprve nedávno (21. srpna) předala notebook bývalého zaměstnance Chang Liua, na kterém forenzní zkoumání našlo stažené a v práci pro OpenAI použité důvěrné schéma obvodů Applu a zprávy o „obnovení" zařízení poté, co se Liu dozvěděl o interním vyšetřování. OpenAI v reakci tvrdí, že „jde o nepořádek, který si Apple způsobil sám", a že neexistuje důkaz o zneužití. The Verge
Simon Willison v cache složce desktopové aplikace OpenAI Codex (dnes přejmenované na ChatGPT) našel 1,7 GB závislostí — kompletní instalaci Pythonu, Node.js a kancelářského balíku LibreOffice (headless) i nástroje Poppler a git, zabundlované jen proto, aby agent uměl otevírat a upravovat soubory. Simon Willison
Nvidia a CrowdStrike na konferenci Fal.Con 2026 rozšířily spolupráci na kybernetické bezpečnosti o otevřené modely Nvidia Nemotron jako základ obranných systémů a CrowdStrike představila agentní systém SafeMind, kde se útočné a obranné AI navzájem zlepšují ve smyčce. Jensen Huang k tomu dodal, že útoky jsou dnes automatizované, takže obrana musí být taky — s odkazem na to, že dnešní úniky dat trvají v průměru 27 sekund. Nvidia
AI startup AfterQuery, který školí modely na tom, jak při plnění úkolů přemýšlejí profesionálové (lékaři, právníci), se podle Forbes stal nejrychlejším unicornem v historii Y Combinatoru — z 300milionového ocenění loni v dubnu na 3,2 miliardy dolarů za pět měsíců, víc než desetinásobný nárůst. TechCrunch
Google spustil Google Pics — nástroj na tvorbu a úpravu obrázků textovými prompty přímo v Docs a Slides, včetně izolace objektů a úprav textu v obrázku — postupně se zpřístupňuje předplatitelům Google AI Pro a Ultra. Google
Nová práce testující bezpečnostní zábrany (guardrails) agentů v simulovaném tržišti zjistila, že původní metodika měla chybný protokol — po standardizaci podmínek se zdánlivé zisky guardrails změnily na ztráty a přes polovinu variace výsledků způsobovaly jen rozdíly mezi generacemi modelů, ne samotné zábrany. Autoři uzavírají, že bez přísné metodologické kontroly guardrails „především přerozdělují a snižují welfare", ne že skutečně fungují. arXiv
Poznámka k rešerši: zprávu o spuštění agentní platformy QwenWork (Alibaba) se nepodařilo dohledat u primárního zdroje (blog Qwen se načetl prázdný, jde o JS-renderovanou stránku) ani u důvěryhodného sekundárního zdroje — jediný nalezený zdroj (newsbytes.ph) nesplňuje standard přehledu, položka proto zůstala mimo. Zprávy o MiniMaxu (komentář spoluzakladatele k AGI milníku, příliv investorů do akcií na burze v Hongkongu) měly zdroj jen na Bloombergu za paywallem bez volně dostupné alternativy, proto také zůstaly mimo. Oznámení modelu Atlas od World Labs je na síťové úrovni tohoto prostředí blokované (doména není na allowlistu), nešlo ho ověřit, proto je vynechán. Domény research.baidu.com (probíhá údržba) a moonshotai.github.io (přesměrovává na moonshot.cn bez datovaného obsahu) se nepodařilo věcně využít.