TL;DR#

  • Anthropic vydala Claude Opus 5.5 — o 40 % levnější a o 30 %+ rychlejší než Opus 5, na většině úloh dosahuje výkonu Fable 5.1. Anthropic
  • OpenAI ve stejný den vydala GPT-6 Sol a Luna, dva levnější odvozené modely od Astry s cenou o polovinu nižší než GPT-5.6. OpenAI
  • Meta přiznala, že jejího agenta Muse “silně inspiroval” nezávislý nástroj OpenClaw — svědčí o tom i shodné názvy konfiguračních souborů jako SOUL.md. TechCrunch
  • Alibaba na konferenci Apsara představila čip Zhenwu V900 (trojnásobný výkon předchůdce, clustery až 500 000 čipů) a oznámila trénink modelu Qwen 5 s 5–10 biliony parametrů. Yahoo Tech
  • DeepSeek bude tento týden spolu s OpenAI a Anthropic briefovat Radu bezpečnosti OSN o rizicích AI — poprvé promluví čínská laboratoř vlastním hlasem, ne přes vládní delegaci. TechNode Global (via Reuters)

Analýza#

Anthropic vydala Claude Opus 5.5, výrazně levnější při srovnatelném výkonu

Anthropic vydala Claude Opus 5.5 s cenou 4 dolarů za milion vstupních a 20 dolarů za milion výstupních tokenů — o 40 % levněji než Opus 5 při typické zátěži, s výstupem o víc než 30 % rychlejším. Na benchmarcích agentního kódování, computer use a znalostní práce překonává Opus 5 a na většině úloh dosahuje nebo přesahuje výkon dražšího Fable 5.1. Verze Sonnet 5.5 a Haiku 5.5 mají následovat v příštích týdnech. Cenový a rychlostní skok bez nutnosti čekat na příští “vlajkový” model ukazuje, že se těžiště konkurence mezi laby přesouvá od čistě nejvyššího výkonu k poměru výkon/cena u modelů o úroveň níž.

OpenAI vydala GPT-6 Sol a Luna ve stejný den jako Anthropic Opus 5.5

OpenAI vydala dva nové modely odvozené od GPT-6 Astra — Sol jako vyvážený model pro agentní kódování a Luna jako odlehčenou, nejlevnější variantu v rodině GPT-6 pro rutinní úlohy jako extrakci nebo směrování požadavků. Ceny klesly zhruba o polovinu oproti GPT-5.6. Že OpenAI i Anthropic vydaly cenově agresivní, “podřazené” modely ve stejný den, není náhoda — obě firmy zjevně reagují na tlak konkurence zdola (čínské open-weight modely, viz níže) tím, že snižují náklady na běžné agentní úlohy, ne že by soutěžily jen o vrchol žebříčků.

Meta přiznala, že agent Muse kopíroval design nezávislého nástroje OpenClaw

Šéf produktu v Meta Superintelligence Labs Nat Friedman přiznal, že Muse byl “silně inspirován” OpenClaw, i když trvá na tom, že byl “postavený od nuly” — jenže Muse obsahuje identicky pojmenované pracovní soubory jako OpenClaw, včetně konfiguračního souboru SOUL.md, a jejich obsah je podle pozorovatelů “téměř totožný”. Friedman otevřeně řekl, že tým OpenClaw “miloval” a chtěl totéž škálovat na miliardy uživatelů. Přiznání přichází týden po zablokování Muse Amazonem kvůli sporům o odpovědnost za objednávky (22.9.) — ukazuje se, že Meta stavěla svého rychle rostoucího agenta doslova na cizím designu, ne na vlastním výzkumu.

Alibaba představila čip Zhenwu V900 a oznámila trénink Qwen 5 s až 10 biliony parametrů

Na konferenci Apsara v Hangzhou Alibaba představila čip Zhenwu V900 s trojnásobným výkonem předchůdce Zhenwu M890, 216 GB HBM pamětí a propustností 1,2 TB/s mezi čipy — cluster z nich má škálovat až na 500 000 kusů pro trénink i inferenci. Masová výroba je plánovaná na první čtvrtletí 2027. Souběžně tým Qwen oznámil přípravu vlajkového modelu Qwen 5 s 5–10 biliony parametrů (oproti 2,4 bilionu u současného Qwen 3.8-Max) a cíl datacenterové kapacity přes 20 GW do roku 2032. Navazuje to na zpoždění čínského konkurenčního čipu Huawei Ascend 960DT na první čtvrtletí 2027 (18.9.) — Alibaba místo zpoždění veřejně demonstruje konkrétní funkční hardware, čímž se v čínském čipovém závodě dostává do čela.

DeepSeek bude spolu s OpenAI a Anthropic briefovat Radu bezpečnosti OSN

Patnáctičlenná Rada bezpečnosti OSN se tento týden (ve středu) sejde k briefingu o rizicích AI za účasti Sama Altmana z OpenAI, vyšších zástupců Anthropicu a — poprvé v této roli — čínských laboratoří DeepSeek a Moonshot, které promluví samostatně, ne přes vládní delegaci. Zakladatel DeepSeek Liang Wenfeng se ale osobně nečeká. Je to viditelný posun oproti prvnímu jednání Rady o AI v roce 2023, kdy Čína mluvila výhradně přes diplomaty. Zapadá to do širšího vzorce z posledních týdnů — tajných jednání labů o bezpečnostních standardech (16.9.) i rámce OpenAI pro hlášení misalignmentu (17.9.) — kde se bezpečnostní diskuse čím dál víc odehrává přímo mezi laby, s vládami jako diváky, ne řídicí silou.

“Measuring the Serving Stack Instead of the Model”: inferenční server sám o sobě mění výsledky agentních benchmarků až o 55 procentních bodů

Nová studie ukazuje, že výsledky benchmarků agentního tool-use závisí nejen na modelu, ale i na tom, jaký inferenční server (Ollama, llama.cpp, vLLM, SGLang) požadavky obsluhuje — rozdíl mezi metodami měření dosahuje až 55 procentních bodů, částečně kvůli tomu, že Ollama u některých modelů odmítá požadavky ještě před inferencí na základě statických šablon, což se pak chybně vykáže jako selhání modelu. Navazuje to na zářijové zjištění, že Gemini 3.0 Pro jako auditor benchmarků sám halucinuje (10.9.) — čím dál víc výzkumu ukazuje, že žebříčky agentních schopností jsou křehčí a metodologicky problematičtější, než jak se s nimi v praxi zachází.

Komentář#

Že Anthropic a OpenAI vydaly cenově agresivní modely ve stejný den, není shoda náhod — je to signál, že se závod přesunul z “kdo má nejchytřejší model” na “kdo dokáže nejlevněji obsloužit miliony agentních volání”. Když k tomu přidáte zprávu Ramp o poklesu AI výdajů u top firem (10.9.) a skepsi Wall Street k tempu investic do datacenter (22.9.) , vzniká jasný obrázek: zákazníci začínají počítat náklady na agenta za úkol, ne za token, a laby na to reagují v reálném čase.

Meta a OpenClaw je nepříjemný precedent — jeden z nejsledovanějších produktů roku (Muse, podle dřívějších dat rychlejší růst instalací než raný ChatGPT) je podle vlastního přiznání firmy z velké části převzatý design nezávislého vývojáře. Otevírá to otázku, kolik dalších “vlastních” agentních produktů velkých firem je ve skutečnosti přebalený harness menšího hráče — a jestli si to Meta může dovolit říct nahlas jen proto, že OpenClaw nemá prostředky na žalobu.

Alibaba dnes ukazuje, jak vypadá čínská odpověď na exportní kontroly v praxi: veřejně demonstrovaný funkční čip s konkrétními čísly (216 GB HBM, 500 000 čipů v clusteru), ne jen ohlášky. V kombinaci s plánovaným Qwen 5 na 5–10 bilionech parametrů je to jasná zpráva, že se čínský ekosystém nezpomaluje kvůli nedostatku hardwaru od Nvidie, ale staví si vlastní paralelní stack — hardware i modely zároveň.

Účast DeepSeek a Moonshotu v Radě bezpečnosti OSN vedle OpenAI a Anthropicu stojí za sledování hlavně proto, že potvrzuje trend, který tenhle přehled zaznamenává už týdny: bezpečnostní debata o AI se čím dál víc odehrává jako přímá dohoda mezi laboratořemi (i napříč geopolitickými bloky), ne jako něco, co diktují vlády. Jestli z toho vzejde něco závazného, nebo jen další fotografie u stolu, uvidíme v následujících dnech.

Studie o vlivu inferenčního serveru na výsledky benchmarků by měla být varováním pro každého, kdo bere agentní žebříčky za bernou minci — když samotná volba software pro obsluhu modelu (ne model sám) dokáže posunout skóre o desítky procentních bodů, znamená to, že velká část srovnání mezi laby, o kterých tenhle přehled týdně píše, může měřit spíš infrastrukturu než skutečné schopnosti.

Ostatní#

Microsoft zpřístupnil GPT-6 Astra, Sol a Luna pro produkční agenty ve Foundry napříč 28 regiony (Azure ) a souběžně přidal i Claude Opus 5.5 pro dlouhoběžící kódovací agenty s novými beta funkcemi asynchronní komprese kontextu (též: Microsoft Tech Community ).

GitHub Copilot ve stejný den zpřístupnil Claude Opus 5.5 napříč všemi plány od Pro+ výš (GitHub ) i GPT-6 Sol a Luna jako volitelné modely (též: GitHub ) — rutina souběžné distribuce nových modelů do vývojářských nástrojů pokračuje stejným tempem jako u předchozích vydání.

Nvidia vydala Isaac ROS 5.0 s “agent-ready” dokumentací a znovupoužitelnými dovednostmi, které mají AI agentům pomáhat automatizovat vývoj robotiky — včetně dovednosti na doladění stereo percepčního modelu FoundationStereo a knihovny FoundationPose pro až 5,5× rychlejší odhad polohy objektů. Nvidia

Startup Snorkel AI ztrojnásobil valuaci na 3,5 miliardy dolarů v kole 350 milionů dolarů, s ročním obratem 375 milionů dolarů (18násobný růst za rok) — firma se z automatizace popisků dat přesunula k prodeji hotových trénovacích datasetů. TechCrunch

Unreal Labs otevřel zdrojový kód nástroje Unreal Agent, kódovacího harnessu s asynchronním voláním nástrojů, který má být o 39 % levnější než Codex+Astra na Terminal-Bench 4.0 při srovnatelném výkonu — diskuze na Hacker News ale upozornila, že srovnání použilo pro obě strany různé konfigurace modelů, takže grafu není radno bezvýhradně věřit. Hacker News

Evropská komise zveřejnila dvě zprávy o vlivu generativní AI a digitálních technologií na vzdělávání v EU — dopad na dovednosti žáků je zatím nejasný, učitelé potřebují výrazně víc proškolení a asi dvě třetiny vzdělávacích systémů už mají vlastní politiku k AI. Evropská komise

Výzkum Agensh (Microsoft Research) ukázal, že decentralizovaný multiagentní systém bez centrálního koordinátora škáluje až na 1024 souběžných agentů a úspěšnost úloh s počtem agentů dál roste — u úlohy s Pandocem vzrostla přesnost z 33,9 % na 55,1 % při škálování z 1 na 1024 agentů. arXiv


Poznámka k rešerši: The Verge, Ars Technica a Business Standard se nepodařilo načíst vůbec, ani přímo, ani přes RSS. U čínských labs se nepodařilo najít nic nového za sledované období u MiniMax, Baidu Research a ByteDance Seed; blog Moonshotu je nedostupný (přesměrování bez obsahu) a DeepSeek/Qwen oficiální blogy nešly strojově přečíst (JS rendering). Několik dalších kandidátů (CNBC, TechNode, US News, Newsmax, Table.Media, Quartz, TradingView, Taipei Times, interconnects.ai) bylo blokováno síťovým proxy tohoto běhu a nešlo je přímo ověřit — použity byly jen ty, u kterých existovala nezávisle dostupná alternativa (Yahoo Tech) nebo kde obsah ověřil dřívější dílčí průchod přes vyhledávání; položka o čínských open-weight modelech vedoucích před americkými (interconnects.ai) byla kvůli nemožnosti ověření raději vynechána úplně. Žádný pokus o prompt injection na navštívených stránkách nebyl zaznamenán.