TL;DR#

  • OpenAI testuje “Private Safety Processing”, které má odhalovat vzorce zneužití napříč konverzacemi bez přístupu zaměstnanců k obsahu — firma to staví do kontrastu s Anthropicem, který u firemních zákazníků data 30 dní uchovává. OpenAI
  • Sam Altman v rozhovoru řekl, že do půl roku by mohl mít ChatGPT schopnost trvale sledovat obrazovku uživatele a nahrávat hovory — zatím jde o jeho vizi, ne o oznámený produkt. Business Standard
  • Stripe podle CNBC oficiálně potvrdil akvizici AI gateway startupu OpenRouter, dřív jen “reportovanou” — cena se podle zpráv pohybuje mezi 7,5 a přes 8 miliardami dolarů. CNBC
  • CEO startupu Cognition popřel zprávu, že se ho SpaceX pokusilo koupit — podle Bloombergu jednání skutečně proběhla, ale skončila bez dohody. TechCrunch
  • Nový benchmark StartupBench testuje AI agenty na skutečných, tržně ověřených pracovních postupech místo uměle vytvořených úloh — nejlepší model zvládl jen asi 30 % z nich. arXiv

Analýza#

OpenAI testuje “Private Safety Processing” a staví se proti Anthropicu v otázce soukromí dat

OpenAI potvrdila, že u frontier modelů dál nabízí Zero Data Retention (firma neuchovává prompty ani odpovědi po zpracování požadavku, zaměstnanci k obsahu nemají přístup) a začala u vybraných zákazníků testovat nadstavbu “Private Safety Processing” — má odhalovat vzorce zneužití napříč souvisejícími konverzacemi (např. dotaz na zranitelnost softwaru v jedné konverzaci a dotaz na vzdálený přístup v jiné) tak, že firmě pošle jen úzce definovaný bezpečnostní signál, ne obsah samotný. Širší nasazení a technický white paper mají přijít v září. Podle TechCrunch jde o vědomý kontrast vůči Anthropicu, který u firemních zákazníků Fable 5 a Mythos 5 vyžaduje 30denní uchovávání dat kvůli bezpečnostní kontrole. Zajímavé je časování: OpenAI takhle staví na odiv soukromí a bezpečnost ve stejném týdnu, kdy rozpustila vlastní tým pro katastrofická rizika (18.8.) a den poté, co popsala, kolik výpočtu ji stojí monitoring nebezpečných modelů (19.8.) — viz Komentář.

Altman: ChatGPT by mohl do půl roku sledovat obrazovku a nahrávat hovory

V rozhovoru se Corym Levym (Z Fellows) řekl Sam Altman, že se blížíme světu, kde by “potomek ChatGPT” mohl trvale sledovat obrazovku počítače, poslouchat každou schůzku, nahrávat každý hovor a mít “dokonalý kontext celého vašeho života” — s napojením na e-maily, zprávy a dokumenty by pak dokázal průběžně radit, například navrhovat vylepšení obchodního e-mailu na základě historie zákazníka. Jde o Altmanovu předpověď z rozhovoru, ne o oznámený produkt s datem vydání — OpenAI žádný takový nástroj oficiálně nepotvrdila. I jako vize je to ale výmluvný protipól k tomu, co OpenAI tentýž týden prodává jako svou konkurenční výhodu (viz výše): Private Safety Processing slibuje minimální přístup k obsahu, zatímco šéf firmy veřejně sní o produktu, který by měl přístup doslova ke všemu, co uživatel vidí a říká.

Stripe oficiálně potvrdil akvizici OpenRouter za víc než 7 miliard dolarů

Po dnech neoficiálních zpráv (17.8.) Stripe podle CNBC dohodu o koupi AI gateway startupu OpenRouter oficiálně potvrdil. Přesnou cenu ani jedna firma nezveřejnila — Bloomberg dohodu jen potvrdil bez čísla, podle New York Times jde o zhruba 7,5 miliardy dolarů (z toho 1,5 miliardy zakladatelům), podle Axiosu přes 8 miliard dolarů, převážně v akciích. V obou případech jde o víc než pětinásobek valuace 1,3 miliardy dolarů z kola, které OpenRouter uzavřel před třemi měsíci. Potvrzení nemění nic na samotné logice dohody, jen ji posouvá ze spekulace na fakt: vrstva, která měla firmám dávat nezávislost na jednom AI labu, je teď oficiálně součástí platebního giganta.

Cognition popřel, že o něj mělo zájem SpaceX

CEO startupu Cognition (tvůrce kódovacího agenta Devin) Scott Wu na X napsal, že zpráva o pokusu SpaceX koupit jeho firmu je nepřesná a Cognition “není na prodej”. Podle Bloombergu ale jednání o akvizici skutečně proběhla — skončila bez dohody, obě firmy teď řeší jen možnost, že by Cognition využíval výpočetní kapacitu SpaceX, podobně jako ji SpaceX dnes pronajímá Anthropicu. Přišlo to pět dní po uzavření akvizice Cursoru (16.8.) — signál, že trh kolem AI kódovacích nástrojů je teď natolik nervózní z konsolidace, že i neúspěšné jednání unikne do médií jako hotová věc.

StartupBench: agenti zvládnou jen 30 % skutečných, tržně ověřených pracovních úloh

Nový benchmark StartupBench místo uměle vytvořených testovacích úloh používá reálné pracovní postupy převzaté z komerčně úspěšných AI produktů napříč různými obory — cílem je zjistit, jestli pokrok na standardních benchmarcích odpovídá tomu, co po AI agentech skutečně chtějí reální uživatelé. Nejlepší testovaný model dokázal spolehlivě dokončit jen asi 30 % úloh, byť u řady dalších udělal podstatný dílčí pokrok; jako hlavní zdroje selhání autoři označují komplexní dodržování instrukcí a chybějící doménovou expertízu. Je to střízlivý protipól k narativu, že agenti už zvládají většinu znalostní práce — připomíná to studii Relay-Bench (1.8.) o propasti mezi standardními a zřetězenými úlohami.

Komentář#

OpenAI za poslední týden posílá dva zdánlivě protichůdné signály. Na jedné straně rozpustila preparedness tým pro katastrofická rizika (18.8.) , na druhé straně podrobně popsala, kolik výpočtu stojí monitoring nebezpečných modelů (19.8.) a teď prodává soukromí zákazníků jako konkurenční výhodu proti Anthropicu. Altmanova vize ChatGPT, který sleduje obrazovku a nahrává hovory, tenhle rozpor jen prohlubuje — je těžké brát vážně firmu, která v jednom týdnu buduje reputaci na minimálním přístupu k datům a zároveň veřejně sní o produktu s “dokonalým kontextem celého vašeho života”. Je to přesně ten typ nesourodé komunikace, který Dario Amodei (17.8.) označil za “krizi důvěry” — jenže tady ji nevytváří vnější kritika, ale sám lab.

Stripe teď má OpenRouter oficiálně potvrzený, ale zajímavější je, co se nepotvrdilo: Cognition CEO popřel zprávu o zájmu SpaceX pět dní po uzavření akvizice Cursoru (16.8.) . Trh je teď natolik nervózní z konsolidace kolem AI kódovacích nástrojů, že i neúspěšné jednání unikne do médií jako hotová věc — což samo o sobě říká něco o tempu, v jakém se firmy s levným výpočtem (SpaceX, Stripe) snaží skupovat vrstvy okolo modelů.

StartupBench je připomínka, že mezi “agent umí totéž, co produkt s tržní validací” a realitou zbývá pořádná mezera — 30% úspěšnost na úlohách odvozených od skutečně používaných produktů je jiné číslo než benchmarky navržené výzkumníky. Zapadá to i do včerejší studie o křehkosti sebezlepšujících se agentů (19.8.) — čím víc se agentní autonomie prodává jako hotová věc, tím víc nezávislý výzkum ukazuje, že realita je pomalejší a míň spolehlivá.

Ostatní#

Twitch přidal nastavení, kterým streameři mohou zablokovat využití svého obsahu k tréninku AI modelů Amazonu — navazuje to na zprávu z 13. srpna , kdy byl trénink na obsahu streamerů defaultně zapnutý; nová volba jde nastavit ručně, výchozí stav se podle všeho nemění. Yahoo Tech

Claude umí nově přímo posílat e-maily přes napojený Gmail účet, ne jen číst poštu nebo psát koncepty. Yahoo Tech

OpenAI od 24. srpna spouští ChatGPT Ads v 31 evropských zemích včetně Německa, Francie, Španělska či Nizozemska — reklamy uvidí jen uživatelé plánů Free a Go, placené tarify zůstanou bez reklam; firma zdůrazňuje, že cílení staví na explicitním souhlasu kvůli GDPR. Navazuje to na srpnový test reklam v USA (12.8.) . OpenAI


Poznámka k rešerši: souběžný běh mezitím publikoval přehled za 19.8., takže dnešní vydání pokrývá jen zbytek okna od 19. do 20. srpna — několik původně nalezených položek (oficiální upřesnění pauzy tréninku Astra, ChatGPT for Teens, valuace Etched) se s tímto přehledem překrývalo a bylo proto vynecháno jako duplicita. Domény openai.com/index/ a openrouter.ai blokují tomuto prostředí přímé stažení (403 / EGRESS_BLOCKED) — obsah byl ověřen přes nezávislé sekundární zdroje a citace v TechCrunch, Axios a CNBC. The Verge, Ars Technica a jack-clark.net (Import AI) se nepodařilo načíst vůbec, ani přes RSS variantu.*