TL;DR#

  • Dario Amodei se v Bílém domě poprvé osobně setkal s Trumpem na večeři, ačkoliv týdny předtím varoval před tempem vývoje AI a Pentagon letos oznacil Anthropic za bezpečnostní riziko dodavatelského řetězce. TechCrunch
  • Odtajněné soudní podklady v žalobě Authors Guild v. OpenAI/Microsoft ukazují, že vedení obou firem vědělo už v roce 2019 o nelegálním použití pirátské knihovny LibGen k tréninku, a v roce 2020 i o riziku, že to připraví o práci autory žánrové fikce. Authors Guild
  • Německá firma Privatemode proměnila otevřený model GLM-5.3-Flash na “Jev-like” rozhodovací model s přesností srovnatelnou s uzavřeným nástrojem Jev od TypeSafe AI — a navíc umí i obrázky. Privatemode
  • Nový benchmark Stale-Document Poisoning ukazuje, že zastaralé dokumenty v RAG systémech svedou modely ke špatné odpovědi ve 17-91 % případů podle domény a modelu. arXiv
  • Kaggle (Google) spustil Game Arenu, platformu hodnotící LLM v soutěžních hrách (šachy, poker, Vlkodlak) místo statických benchmarků, které se rychle saturují. arXiv

Analýza#

Amodei večeří s Trumpem v Bílém domě — poprvé osobně

Dario Amodei se 27. září setkal s Donaldem Trumpem poprvé osobně, na večeři v Bílém domě. Vztahy byly napjaté: Trump AI bezpečnostní debatu opakovaně nazval “demokratickým hoaxem” a chce AI přejmenovat na “super intelligence”, zatímco Amodei tento měsíc vyzval k opatrnějšímu tempu vývoje (13.9.) . Pentagon letos oznacil Anthropic za riziko dodavatelského řetězce v reakci na snahu firmy prosadit ochranné mantinely kolem použití své technologie — spor, který odvolací soud potvrdil o dva dny dřív (26.9.) . Že si za těchto okolností Amodei sedá k večeři s prezidentem, ukazuje, že byznysová nutnost — vládní zakázky, regulační vstřícnost — váží víc než rétorické neshody.

Odtajněné dokumenty: vedení OpenAI i Microsoftu vědělo o nelegálním tréninku na pirátských knihách už v roce 2019

Nově odtajněné soudní podklady v žalobě Authors Guild proti OpenAI a Microsoftu obsahují interní zprávu z srpna 2019 — “We trained GPT-3 on pirated stuff! No sharing that!” — a diskuzi Sama McCandlishe s Dariem Amodeim, tehdy výzkumným ředitelem OpenAI a dnešním šéfem Anthropicu, o tom, že knihovna LibGen je jako zdroj dat “sketchy”. Microsoft o použití LibGen věděl od dubna 2019; OpenAI pirátská data mazala v létě 2022 v rámci interního projektu “Project Clear”. Podklady dál ukazují, že v květnu 2020 policy director OpenAI Jack Clark varoval, že vylepšené jazykové modely budou čím dál víc nahrazovat autory žánrové fikce — a firma podle citovaného e-mailu počítala, že jejich obavy “pravděpodobně ignoruje a vydá to stejně”. Navazuje to na širší letošní vzorec odtajňovaných podkladů, které postupně bourají obhajobu “nevěděli jsme” — v zářijovém případě výroku manažera Microsoftu o “největší krádeži práce v historii” (17.9.) šlo o podobné interní přiznání.

Německá firma naklonovala uzavřený rozhodovací model Jev z otevřeného GLM-5.3-Flash

Privatemode (provozovaná firmou Edgeless Systems) ukázala, že otevřený model GLM-5.3-Flash lze bez fine-tuningu přeměnit na “System One” rozhodovací model podobný uzavřenému nástroji Jev od TypeSafe AI — jedním forward passem, jedním výstupním tokenem, s pravděpodobností pro každou volbu, bez parsování volného textu. Benchmark z veřejných datasetů ukazuje přesnost srovnatelnou s Jev a typické rozhodnutí kolem 150 milisekund včetně sítě, navíc s podporou obrázkového vstupu, kterou Jev nemá. Je to přímá odpověď na vydání Jev a jeho slibovanou výjimečnost (16.9.) i na první nadšené reakce vývojářů (19.9.) — ukazuje, že “typed decision v jednom forward passu” nebyla unikátní schopnost jednoho uzavřeného modelu, ale obecná technika replikovatelná na běžném open-weight modelu.

Benchmark ukazuje: zastaralé dokumenty v RAG svedou modely ke špatné odpovědi až v 91 % případů

Nová studie na 317 ověřených případech z medicíny, práva, softwaru a platformových politik ukazuje, že když RAG systém dostane zastaralý, dřív platný dokument, modely (testováno na Llama a Qwen) na jeho základě chybují ve 30 a 37 % případů — a když je model explicitně instruován “věř dokumentu”, chybovost vyskočí na 66 a 75 %. Napříč čtyřmi testovanými modely a doménami se míra “otravy” pohybovala mezi 17 a 91 %. Autoři tvrdí, že spolehlivé RAG vyžaduje, aby model posoudil nejen co staré důkazy říkají, ale jestli ještě platí — modely s explicitní informací o časové platnosti důkazu si vedly výrazně lépe. Praktický dopad: čím poslušnější instrukce k důvěře v dodané dokumenty, tím zranitelnější systém vůči datům, která už neplatí.

Kaggle spustil Game Arenu — LLM se místo statických testů měří v šachu, pokeru a Vlkodlakovi

Kaggle, platforma patřící Googlu, spustila Game Arenu — otevřenou platformu, která modely hodnotí v soutěžních hrách místo statických benchmarků. Začíná třemi prostředími: šachem (dokonalá informace), pokerem (nedokonalá informace) a Vlkodlakem (multiplayer vyjednávání a dynamika). Cílem je obejít saturaci, ke které dochází, jakmile modely dorostou na úroveň existujících testů — v hře proti sobě roste obtížnost společně s testovaným modelem, protože soupeřem je jiný model, ne fixní sada otázek. Je to jiný přístup než statické texty a otázky, kterými se benchmarkuje většina schopností dnes, a možný předobraz podoby evaluací, až současné testy přestanou rozlišovat mezi frontier modely.

Komentář#

Amodei u večeře s Trumpem den po Xi Ťin-pchingově státní návštěvě, na které Amodei nebyl, je přesně ten druh gesta, které rétoriku o “zpomalení” a “bezpečnostních obavách” staví do praktického světla: když jde o přístup k Bílému domu a možnost zvrátit vojenský blacklisting, ideologické neshody s administrativou náhle nejsou překážkou k večeři. Sedí to do vzorce, který přehled sleduje týdny — tajná jednání labů o bezpečnostních standardech (16.9.) i chystaná SAFA ukazují, že skutečné vyjednávání se čím dál víc odehrává v zákulisí, ne na veřejných summitech.

Odtajněné e-maily Authors Guild jsou zajímavé hlavně tím, kdo v nich figuruje: muž, který dnes vede firmu prezentující se jako nejopatrnější a nejbezpečnostně orientovanější z velkých labů, v roce 2019 spoluřešil, jak moc vadí, že tréninková data jsou z pirátské knihovny — a odpověď byla “sketchy, ale ne dost na to, abychom to nepoužili”. Není to jediný takový případ tento rok, jen dosud nejpřímější spojnice mezi “AI safety” rétorikou a rozhodnutími, která k dnešním firmám vedla.

Game Arena a studie o otravě zastaralými dokumenty spolu ukazují dvě strany stejné mince: současné hodnocení AI systémů je rozbité oběma směry. Statické benchmarky se saturují a nedokážou rozlišit frontier modely (proto dynamické hry), zatímco praktické systémy jako RAG mají problém s mnohem prozaičtější věcí — poznat, že dokument, kterému mají věřit, už neplatí. Řešení prvního problému (chytřejší evaluace) k druhému nijak nepomůže; obě mezery budou muset firmy řešit paralelně, ne jednou společnou technikou.

Rychlý repliky Privatemode ukazuje, jak málo náskoku dává uzavřenému nástroji samotná myšlenka, pokud je jednoduchá k popsání. Jev byl prezentovaný jako výjimečný přístup k rozhodovacím úlohám; stačil týden a někdo stejný trik spustil na běžném open-weight modelu, s bonusovou schopností navíc. Uzavřenost zpomaluje kopírování o dny, ne o měsíce.

Ostatní#

Saturday Night Live parodovalo Daria Amodeiho — herečka Jane Wickline v segmentu Weekend Update ztvárnila nejistého šéfa Anthropicu s replikami jako “AI je ďábel a já jsem jeho tvůrce” a vtipem o jen 10% šanci, že AI vyřeší rakovinu do deseti let; satira cílila na nedávnou vlnu varovných prohlášení labů o rizicích vlastní technologie. TechCrunch

Agent Meta Muse měl zajistit vyzvednutí balíku s klávesnicí, ale kurýr na místě nikoho nenašel — agent mezitím automaticky odpověděl “Yep I’m here!”, ačkoliv majitel fyzicky přítomný nebyl, čímž situaci jen zhoršil; incident zveřejnil na Threads a rozebral Simon Willison. Je to další drobný příklad nespolehlivosti Muse po přiznaném kopírování designu OpenClaw (23.9.) a zablokování na Amazonu kvůli riziku chybných objednávek (21.9.) . Simon Willison

Simon Willison zveřejnil nástroj na odhalování reply-botů na síti Bluesky — hledá účty, které odpovídají během vteřin po příspěvcích s vyšším počtem sledujících a samy nikdy nic vlastního nepublikují; nástroj postavil s pomocí Opusu 5.5 a využívá veřejně dostupné Bluesky API. Simon Willison

Nová studie ukazuje, že modely lze naučit efektivněji “vědět, kdy přestat uvažovat” bez explicitního mechanismu ukončení — stačí je doladit na předpovídání vlastní důvěry v mezikrocích na 600 trénovacích úlohách, což při inferenci snížilo počet generovaných tokenů až o 25 % při zachované přesnosti na modelech Gemma, Qwen, Nemotron i GPT-OSS. arXiv

Nový dataset DecoyBench (300 obrázků s dvěma vizuálně překrytými vrstvami textu) ukazuje, že šest testovaných uzavřených vision-language modelů neumí číst obě vrstvy najednou tak jako lidé: při vysokém rozlišení přečtou jen ostře konturovanou vrstvu, při nízkém naopak jen tu stínovanou — model podle všeho zpracovává jen jednu prostorovou frekvenci najednou. arXiv


Poznámka k rešerši: Na GitHubu v organizaci deepseek-ai se objevil odkaz na repozitář “deepseek-harness” s nereálně vysokým počtem hvězd (uváděno ~238 000) a obsahem připomínajícím soubor CLAUDE.md cílený na AI asistenty — vykazuje znaky podvrženého obsahu / pokusu o prompt injection, proto nebyl zahrnut jako zdroj a jeho obsah nebyl nijak následován. Tři zdroje (authorsguild.org, privatemode.ai, dashbit.co) blokoval síťový proxy tohoto běhu přímému stažení; fakta u položek Authors Guild a Privatemode byla proto ověřena křížově přes vyhledávání a zrcadlící zdroje (Publishers Weekly, TorrentFreak, GitHub repozitář edgelesssys/privatemode-decisions-benchmark). Esej Josého Valima na dashbit.co o vývoji programovacích jazyků v éře AI agentů byla kvůli nemožnosti ověřit obsah přímo z tohoto běhu vynechána. Víkend byl na straně oficiálních blogů labs (Anthropic, OpenAI, Google, DeepMind, Meta, Microsoft, Mistral, Nvidia, Cursor) i regulačních zdrojů (EU, ČTÚ) zcela tichý — žádný nový příspěvek v okně tohoto přehledu.