Neue Bewertung vom US Center for AI Standards and Innovation ist gerade erst veröffentlicht worden.
Moonshot AI’s Kimi K3 erreichte nur 32,2% in der Fähigkeit zur Ausnutzungsentwicklung.
Führende US-Frontier-Modelle? 76,2%.
Das ist eine ziemlich große Lücke.
Der Bericht stellt außerdem fest, dass die Schutzmaßnahmen von Kimi K3 in einigen Fällen dennoch die Unterstützung bei der Ausnutzungsentwicklung zulassen.
Cyber-Fähigkeits-Benchmarks wie diese werden immer wichtiger, wenn Modelle leistungsfähiger werden.
Spannend zu sehen, wie groß der Unterschied auf diesem speziellen Messwert immer noch ist.
#AI #KimiK3 #rsshanto #Cybersecurity #LLM $BILL $RE $RIF
Moonshot AI’s Kimi K3 erreichte nur 32,2% in der Fähigkeit zur Ausnutzungsentwicklung.
Führende US-Frontier-Modelle? 76,2%.
Das ist eine ziemlich große Lücke.
Der Bericht stellt außerdem fest, dass die Schutzmaßnahmen von Kimi K3 in einigen Fällen dennoch die Unterstützung bei der Ausnutzungsentwicklung zulassen.
Cyber-Fähigkeits-Benchmarks wie diese werden immer wichtiger, wenn Modelle leistungsfähiger werden.
Spannend zu sehen, wie groß der Unterschied auf diesem speziellen Messwert immer noch ist.
#AI #KimiK3 #rsshanto #Cybersecurity #LLM $BILL $RE $RIF