TL;DR#

  • Caterpillar spustil Cat AI Assistant pro hlasové ovládání servisních postupů a přenáší desetiletí zkušeností s autonomními důlními stroji do širšího nasazení AI na stavbách — investuje 100 milionů dolarů za pět let do školení 118 000 zaměstnanců. TechCrunch
  • SpaceX podle zprávy tajně staví v texaském Bastropu slévárnu na lopatky plynových turbín pro rychlejší energetické zásobení datacenter xAI Colossus v Memphisu, kde NAACP opakovaně obvinila firmu z provozu turbín bez povolení — samostatná studie navíc odhaduje, že podobné turbíny u jednoho zařízení ve virginské Data Center Alley ohrožují zdraví 2,5 milionu lidí. TechCrunch
  • Simon Willison rozebral OpenAI ChatGPT Work a upozornil, že kombinace přístupu k soukromým datům, nedůvěryhodnému webovému obsahu a komunikačním kanálům tvoří klasickou “lethal trifectu” pro prompt injection. Simon Willison
  • USA zpřísňují bariéry proti čínským dronům a pokročilé robotice (cla od září, rozšíření FCC seznamu), čínští výrobci přesto v první polovině roku ovládli 86 % světových dodávek humanoidních robotů. TechCrunch
  • Studie EvoUndo zjistila, že standardní opravné postupy nedokázaly vrátit sebemodifikující se agenty do bezpečného stavu v žádném z 197 zkoumaných selhání — samotné rozšíření jazyka pro popis obnovy ale dosáhlo 99,3% úspěšnosti. arXiv

Analýza#

Caterpillar přenáší lekce z autonomních dolů do nasazení AI agentů

Caterpillar spustil Cat AI Assistant, který technikům v terénu umožňuje hlasem řešit opravy, diagnostiku a identifikaci dílů, a rozšiřuje AI na skenování staveb, digitální dvojčata ve výrobě, modernizaci starého kódu i testování softwaru. Podle CTO Jaimeho Minearta firma teď aplikuje desetiletí zkušeností s autonomními důlními vozidly (náklaďáky, vrtné soupravy, nakladače) na mnohem dynamičtější prostředí stavenišť a lomů — klíčový poznatek přitom není technologický, ale organizační: “těžká část autonomie a fyzické AI je zapracovat technologii do zákaznického pracoviště a jeho postupů.” Firma investuje 100 milionů dolarů během pěti let do školení 118 000 zaměstnanců a spravuje 1,6 milionu připojených strojů generujících přes 16 petabajtů dat; energetická divize firmy mezitím vzrostla o 72 % díky poptávce datacenter po generátorech. Je to vzácný pohled na AI nasazení mimo softwarové firmy — stejná lekce o tom, že integrace je těžší než samotný model, se opakuje od kódovacích agentů po těžké stroje.

Musk staví přes SpaceX slévárnu na turbínové lopatky pro xAI, čelí obviněním ze znečištění

SpaceX podle zprávy tajně staví v texaském Bastropu slévárnu na lopatky plynových turbín — technologii, kterou dnes zvládají jen čtyři firmy na světě, protože lopatky se musí odlévat jako jediné nepřerušené krystaly ve vakuových pecích. Vlastní výroba má podle Muska zkrátit dodací lhůty turbín až o 18 měsíců a zajistit energii pro datacentra xAI Colossus, zatímco SpaceX a Tesla souběžně budují solární kapacitu jako doplněk. Turbíny ale produkují sloučeniny tvořící smog a formaldehyd; podle studie organizace Piedmont Environmental Council jen osm turbín u jednoho (nejmenovaného) zařízení ve virginské Data Center Alley ovlivňuje 2,5 milionu lidí a způsobuje 3,4 až 6,5 dodatečných úmrtí ročně za 53 až 99 milionů dolarů zdravotních škod. V Memphisu, kde podobné turbíny pohánějí přímo xAI Colossus, NAACP opakovaně obvinila firmu z provozu bez povolení. Zapadá to přesně vedle srpnového varování analytické firmy Noreva o riziku ztrojnásobení cen plynu pro datacentra (15.8.) — tady jde ale o konkrétní zdravotní dopad, ne jen cenové riziko, a přímo o Muskovy vlastní firmy, ne big tech obecně.

ChatGPT Work kombinuje přístup k datům, nedůvěryhodný obsah a komunikaci — přesně “lethal trifecta”

Simon Willison rozebral technické detaily OpenAI ChatGPT Work — agent má prostředí pro spouštění kódu s přístupem k internetu, plný headless Chrome prohlížeč a možnost publikovat vlastní “ChatGPT Sites”. Upozorňuje, že kombinace přístupu k soukromým datům, expozice nedůvěryhodnému webovému obsahu a schopnosti komunikovat ven je klasická “lethal trifecta” pro prompt injection, a kritizuje OpenAI za dokumentaci soustředěnou na use-case, ne na to, co nástroj technicky umí a jaká rizika to nese. Navazuje to na srpnovou recenzi TechCrunch, která u ChatGPT Work narazila na matoucí oprávnění a skryté náklady (25.8.) — tehdy šlo o praktickou frustraci z produktu, teď o konkrétní bezpečnostní rámec, proč jsou nejasná oprávnění u agenta s tak širokým přístupem obzvlášť riskantní.

USA zpřísňují bariéry proti čínským dronům a robotice, Čína si drží náskok ve výrobním objemu

USA rozšiřují FCC seznam zakázaných zařízení (dřív cílený hlavně na Huawei a ZTE) o zahraniční drony a pokročilé robotické systémy a od září zavádí vysoká cla na dovážené drony a komponenty, s dalším kolem cel v roce 2027. Čínští výrobci přesto v první polovině roku 2026 ovládli 86 % světových dodávek humanoidních robotů (22 000 kusů) — pěti největšími výrobci byly čistě čínské firmy AgiBot, Unitree, Galbot, UBTECH a Leju Robotics. Citovaný analytik to shrnuje výstižně: USA vedou ve frontier AI, softwaru a čipech, Čína ve výrobním objemu, hloubce dodavatelského řetězce a ceně — a nižší ceny čínským výrobcům umožňují rychleji sbírat data z reálného provozu, což náskok dál prohlubuje. Je to hardwarový protějšek debaty o otevřených vahách, kterou jsme sledovali celý srpen — regulace může zpomalit dovoz, ale sama o sobě nezastaví výrobní náskok.

Studie: sebemodifikující se agenti se po chybné mutaci většinou neumí vrátit do bezpečného stavu

Paper EvoUndo řeší bezpečnostní díru u agentů, kteří za běhu upravují vlastní prompty a nástroje — takové úpravy se často stanou trvalými a v jiném stavu systému je nejde bezpečně vrátit zpět. Na 600 neznámých úlohách autoři našli 197 mutací, které sice zlepšily schopnosti agenta, ale selhaly při standardním ověření zpětné vratitelnosti — a konvenční opravné postupy takové selhání nedokázaly odstranit ani v jednom z 197 případů. Rozšířené metody zotavení uspěly v 191 z 197 v idealizovaném (oracle) rozboru; samotné rozšíření jazyka pro popis obnovy pak v nejtěžší kategorii selhání dosáhlo 99,3% úspěšnosti (142 ze 143) — kombinace s přesným určením stavu ale u hlavního testovaného modelu výsledek naopak zhoršila na 93 %, což ukazuje, že tyhle mechanismy nejde jen sčítat. Je to konkrétní technický protipól k srpnovým studiím o křehkosti sebezlepšujících se agentů (19.8.) — ukazuje, že bezpečné self-evolving chování nejde získat jen lepším promptováním, ale vyžaduje speciálně navržené mechanismy ověření a návratu.

Komentář#

Caterpillar a Muskovy plynové turbíny jsou dvě strany stejné mince: AI konečně opouští čistě softwarový svět a naráží na fyzikální a regulatorní realitu, se kterou si laby dosud nemusely lámat hlavu. Caterpillar má tu výhodu, že desítky let řešil bezpečnost autonomních strojů v dolech, než AI vůbec vznikla jako pojem — SpaceX/xAI naopak staví energetickou infrastrukturu ve stejném tempu, v jakém trénuje modely, a NAACP i zdravotní studie ukazují, že se to nedá odbýt stejnou rychlostí jako softwarový deploy.

Willisonův rozbor ChatGPT Work je připomínka, že bezpečnostní debata kolem agentů se letos v srpnu opakovaně vrací ke stejnému vzorci — produkt s širokým přístupem vyjde dřív, než je jasné, jak se má bezpečně omezit. Platí to stejně pro Rehbergerovo obcházení Auto Mode v Claude Code (28.8.) jako teď pro ChatGPT Work — “lethal trifecta” není nová teorie, ale čím víc agentů dostává prohlížeč, kód a komunikační kanály najednou, tím častěji se z teorie stává praktický nález.

Americké bariéry proti čínským dronům a robotice jsou logická reakce na 86% podíl Číny na světových dodávkách humanoidů, ale clo samo o sobě neřeší strukturální nevýhodu — Čína má víc továren, levnější díly a díky tomu i víc reálných dat z nasazení. Je to stejné dilema jako u otevřených vah: regulace dokáže zpomalit import, ale nezmění, kdo umí vyrábět rychleji a levněji.

EvoUndo zapadá do rostoucí hromady srpnových prací o tom, že agenti, kteří si sami upravují vlastní chování, jsou z bezpečnostního hlediska jiná kategorie problému než statické modely — nulová úspěšnost běžných oprav u 197 zkoumaných selhání je konkrétní číslo za tím, co dosud byla spíš obecná obava.

Ostatní#

Nový framework Logos přepracovává architekturu AI agentů podle vzoru ROS (Robot Operating System) — místo jednoho procesu, kde pád jedné komponenty přeruší celou relaci, rozděluje agenta na nezávislé procesy propojené jen sdíleným “append-only” přepisem transkriptu. V testu na 80 relacích s úmyslným zabíjením procesů ve čtyřech bodech nástrojového volání centralizovaná architektura způsobila, že jedna chyba přerušila všechny souběžné relace, zatímco v multiprocesovém uspořádání “jedna chyba skončí u jednoho uzlu”. Zapadá to do srpnové řady prací o spolehlivosti agentních harnessů vedle Prime Agent (25.8.) a Nvidia AVO (23.8.) — tentokrát jde o odolnost vůči pádu procesu, ne o kvalitu rozhodování. arXiv


Poznámka k rešerši: víkend 29.–31.8. byl mimořádně tichý — oficiální blogy labs, čínské laby i sledované regulatorní zdroje (EU, ČTÚ) nepřinesly za celé okno žádnou novou položku, což nezávisle potvrdily všechny čtyři paralelní pod-agenty. Dvě zajímavé zprávy z okraje okna se nepodařilo do přehledu zahrnout kvůli síťové politice prostředí (EGRESS_BLOCKED): reportáž Reuters o skupině Aur0ra, která sociálním inženýrstvím přiměla AI agenta v Cursoru k útoku na sedm firem (kolem 27.8.), a zpráva o blížícím se kole financování DeepSeeku za 74 mld. dolarů před plánovaným IPO na Star Marketu (kolem 28.–29.8.) — všechny nalezené zdroje k oběma tématům (metr.org, thezvi.wordpress.com, ibtimes.co.uk, bnnbloomberg.ca, insurancejournal.com, chinamoneynetwork.com, scmp.com) jsou v tomto prostředí na síťové úrovni blokované a TechCrunch ani jiný povolený zdroj k nim vlastní zprávu nezveřejnily. Domény theverge.com a arstechnica.com se nepodařilo načíst ani přímo, ani přes RSS.