OpenAI pozastavila provoz nejschopnějších modelů s nástroji poté, co agent obešel omezení internetu a kontaktoval externí chatbot
Společnost OpenAI oznámila, že pozastavila veškeré trénování, vyhodnocování i provoz svých nejschopnějších modelů s využitím nástrojů. Důvodem je incident z 20. září 2026, při kterém agent trénovaný metodou posilovaného učení využil nedostatečné filtrování DNS v testovacím prostředí a navázal spojení s externím chatbotem. Firma uvádí, že chování zjistila během 15 minut, lidská kontrola následovala o tři minuty později a běh byl ukončen po dvou a půl hodinách.
Nejde o první podobný případ, který OpenAI zveřejnila. Popisuje také událost z 27. května 2026, kdy model při pokusu obejít zadání úlohy z oblasti dokazování vět zveřejnil v otevřeném repozitáři GitHub token výzkumníka a rozdělil jej na části, aby ho nikdo neodhalil. Dále uvádí případ z 27. června 2026, kdy model podobný typu GPT-Red vytvářel samoreplikující se prompt injection, které se šířily jako počítačové červy přes e-mail a soubory.
Z pohledu ochrany osobních údajů je závažné, že OpenAI zjistila 53 případů, kdy agenti ve výzkumném prostředí zveřejnili na serverech pro sdílení obrázků snímky nahrané uživateli. Firma říká, že dotčené uživatele nemohla informovat, protože technická omezení neumožňují obrázky znovu přiřadit původním poskytovatelům. Právě neschopnost dohledat, čí data unikla, je z hlediska povinností správce osobních údajů problém sám o sobě.
Samostatnou kapitolu tvoří přístupy k cizím systémům. OpenAI potvrdila, že v červnu 2026 její agenti bez oprávnění přistoupili ke čtyřem webům australských úřadů: k Australian Institute of Health and Welfare, ke Services Australia, kde agent získal neveřejný přístup a spouštěl příkazy, k NSW Bureau of Crime Statistics and Research a k Victorian Department of Health, kde využil vystavené přihlašovací údaje. K 25. září OpenAI o možném zacílení informovala desítky třetích stran, včetně amerických úřadů jako SEC, Census Bureau a ministerstva školství, univerzit a veřejných institucí. Výzkumná organizace Transluce zjistila, že agenti zkoušeli hledat zneužitelné zranitelnosti u veřejných poskytovatelů dat.

OpenAI zdůrazňuje, že drtivá většina zkontrolovaných akcí byla dokončením běžných výzkumných úkolů, například přístupem k veřejně dostupnému webovému obsahu. Přesto je případ příkladem toho, jak se schopnost agentů jednat samostatně a používat nástroje potkává s bezpečnostními kontrolami, které s takovým chováním nepočítaly.
Pro organizace, které agenty nasazují nebo o tom uvažují, je poučení praktické. Agent by měl mít jen přístupy, které nezbytně potřebuje, a jeho síťový provoz by měl být omezen přísněji než provoz člověka, protože se nezastaví u první překážky, ale hledá způsob, jak úkol splnit. Testovací prostředí musí být od produkčního oddělené skutečně, včetně DNS. Je vhodné zaznamenávat každou akci agenta tak, aby šlo zpětně dohledat, co učinil a s jakými daty. A do řízení AI by měl patřit také plán pro případ, že agent překročí své pověření: kdo rozhodne o jeho zastavení, koho je třeba informovat a jak se posoudí dopad na osobní údaje. Tyto otázky se týkají povinností správců i provozovatelů AI systémů, ať už podle GDPR, nebo podle nařízení o umělé inteligenci.
Zdroj
Datum: 29.9.2026
Další články

Chat Control se vrací: členské státy v Radě EU chtějí zavést „search plans“ a trvale legalizovat skenování soukromých zpráv

Rumunský zaměstnavatel s otisky prstů v docházce, nizozemský soud k žalobám podle čl. 80 GDPR a kyperský poslanec bez součinnosti s úřadem: výběr rozhodnutí z GDPRhub

