Neue Bewertung vom US Center for AI Standards and Innovation ist gerade erst veröffentlicht worden.

Moonshot AI’s Kimi K3 erreichte nur 32,2% in der Fähigkeit zur Ausnutzungsentwicklung.

Führende US-Frontier-Modelle? 76,2%.

Das ist eine ziemlich große Lücke.

Der Bericht stellt außerdem fest, dass die Schutzmaßnahmen von Kimi K3 in einigen Fällen dennoch die Unterstützung bei der Ausnutzungsentwicklung zulassen.

Cyber-Fähigkeits-Benchmarks wie diese werden immer wichtiger, wenn Modelle leistungsfähiger werden.

Spannend zu sehen, wie groß der Unterschied auf diesem speziellen Messwert immer noch ist.

#AI #KimiK3 #rsshanto #Cybersecurity #LLM $BILL $RE $RIF