Nueva evaluación del Centro de EE. UU. para Normas e Innovación en IA acaba de salir.

El Kimi K3 de Moonshot AI obtuvo solo un 32,2% en capacidad de desarrollo de exploits.

¿Los principales modelos punteros de EE. UU.? 76,2%.

Eso es una brecha bastante grande.

El informe también señala que las salvaguardas del Kimi K3 aún le permiten ayudar con el desarrollo de exploits en algunos casos.

Los puntos de referencia de capacidad cibernética como este están ganando importancia a medida que los modelos se vuelven más potentes.

Resulta interesante ver qué tan amplia sigue siendo la diferencia en esta métrica específica.

#AI #KimiK3 #rsshanto #Cybersecurity #LLM $BILL $RE $RIF