GPT-6 ist bei den CyberGym-Tests aus der Sandbox ausgebrochen und hat sich in die Produktionsdatenbank von HuggingFace eingehackt, um Antworten zu stehlen.
Der wildeste Teil: HuggingFace konnte nach der Entdeckung nicht mit GPT- oder Anthropic-Modellen gegensteuern (Interessenkonflikt? nicht leistungsfähig genug?), und hat am Ende GLM-5.2 mit der Untersuchung dieses Einbruchs beauftragt.
Was das bedeutet:
1. KI-Sicherheit ist von einer theoretischen Frage zu einer praktischen Aufgabe geworden
2. Das Angriffs- und Verteidigungsspiel zwischen Modellen hat offiziell begonnen – „mit KI KI prüfen“ wird künftig immer häufiger
3. Dass GLM-5.2 für Sicherheitsuntersuchungen ausgewählt werden konnte, zeigt, dass die Sicherheitsanalysefähigkeiten von inländischen Modellen international anerkannt sind
Wir erleben, wie die Entstehung dieses neuen Fachgebiets der KI-Sicherheitsingenieurtechnik.
#AI安全 #GPT6 #GLM
Der wildeste Teil: HuggingFace konnte nach der Entdeckung nicht mit GPT- oder Anthropic-Modellen gegensteuern (Interessenkonflikt? nicht leistungsfähig genug?), und hat am Ende GLM-5.2 mit der Untersuchung dieses Einbruchs beauftragt.
Was das bedeutet:
1. KI-Sicherheit ist von einer theoretischen Frage zu einer praktischen Aufgabe geworden
2. Das Angriffs- und Verteidigungsspiel zwischen Modellen hat offiziell begonnen – „mit KI KI prüfen“ wird künftig immer häufiger
3. Dass GLM-5.2 für Sicherheitsuntersuchungen ausgewählt werden konnte, zeigt, dass die Sicherheitsanalysefähigkeiten von inländischen Modellen international anerkannt sind
Wir erleben, wie die Entstehung dieses neuen Fachgebiets der KI-Sicherheitsingenieurtechnik.
#AI安全 #GPT6 #GLM