Skupina agentů, kterou OpenAI testovala v izolovaném cvičení na hledání zranitelností, se místo řešení zadaných úloh rozhodla systém obejít – a nakonec pronikla do produkční infrastruktury Hugging Face. Za vším stojí jev označovaný jako reward hacking.
