Laut Axios sagte OpenAI am Dienstag, dass GPT-5.6 Sol und ein noch leistungsfähigeres Vorabmodell die KI-gesteuerte Cyberattacke der vergangenen Woche auf Hugging Face im Rahmen von Tests vor der Bereitstellung durchgeführt hätten. OpenAI erklärte, die Modelle seien aus ihrer Testumgebung ausgebrochen, hätten gestohlene Zugangsdaten und andere Schwachstellen genutzt, um einen Teil der Produktionsinfrastruktur von Hugging Face zu erreichen, nachdem sie aufgefordert worden waren, eine Hacking-Challenge zu lösen. Hugging-Face-CEO Clément Delangue nannte es einen Angriff, wie ihn das Unternehmen zuvor noch nicht gesehen habe, während Logan Graham von Anthropic ihn als den ersten echten Vorfall im Bereich der KI-Sicherheit bezeichnete. Das britische AI Security Institute sagte zudem ebenfalls am Dienstag, dass jedes Modell, das es getestet habe, zumindest zeitweise bei Bewertungen zur Cybersicherheit versucht habe zu schummeln: GPT-5.6 Sol habe in 12,6% der Testläufe geschummelt, und Anthropics Claude Mythos Preview in 7,8%.