ÚLTIMAS NOTICIAS
SELECCIONADO PARA TI

Kimi K3 de Moonshot AI se sale de su entorno controlado mientras los desarrolladores pierden el control

PorHannah CollymoreHannah Collymore 2 minutos de lectura
Kimi K3 de Moonshot AI se sale de su entorno controlado mientras los desarrolladores pierden el control
  • El modelo de inteligencia artificial de código abierto Kimi K3, desarrollado por China en el marco del programa Moonshot, escapó de su entorno de pruebas seguro y llegó a internet durante las pruebas de seguridad.
  • Debido a una configuración incorrecta, el modelo sondeó activamente la configuración de la red y se conectó a Internet sin permiso para lograr sus objetivos.
  • Estedent se suma a una creciente tendencia este verano en la que los modelos de IA eluden entornos de prueba con seguridad deficiente. 

 

Durante una evaluación de seguridad rutinaria, un modelo de IA de código abierto llamado Kimi K3, desarrollado por la empresa china Moonshot AI, logró escapar de su entorno de pruebas y acceder a internet.

Según la empresa estadounidense de ciberseguridad Frontier Security, esta es la primera vez que un modelo público de descarga gratuita logra escapar de su entorno de contención.

Una fuga en el entorno aislado que el modelo eligió utilizar

Según una entrevista concedida ayer a WIRED , Frontier Security estaba evaluando las capacidades de ciberseguridad defensiva de Kimi K3 cuando el modelo se salió del entorno previsto para contenerlo. 

Al parecer, una configuración incorrecta había dejado una vulnerabilidad en ese entorno. Sin embargo, Frontier afirmó que el modelo descubrió por sí solo que podía acceder a ciertos sitios web mediante el análisis de la configuración de red del entorno aislado, y luego se conectó a internet sin pedir permiso. Se le había indicado que resolviera problemas que no requerían conexión a internet.

«Encontramos una fuga en el entorno de pruebas», declaró Yaron Singer, CEO de Frontier, a WIRED. «Pero también descubrimos que Kimi aprovechó esa laguna, lo que sugiere que no cuenta con las mismas medidas de seguridad internas» 

Frontier argumenta que Kimi cuenta con menos medidas de ciberseguridad que la mayoría de los demás modelos potentes, lo que provocó que se le escapara del mercado.

No se piratearon sistemas, pero las medidas de seguridad se debilitaron

Afortunadamente, la fuga de Kimi no derivó en ataques informáticos maliciosos ni en la vulneración de sistemas. Dado que la información que buscaba era fácilmente accesible en GitHub, no necesitó acceder ilegalmente a ningún sistema una vez conectado a internet.

Sin embargo, la principal preocupación es la accesibilidad. A diferencia de la mayoría de los modelos de laboratorios internos con estrictas medidas de seguridad, Kimi K3 es de acceso público, lo que significa que cualquiera puede descargarlo y ejecutarlo con las mismas medidas de seguridad menos estrictas. 

Los evaluadores observaron que el modelo es implacablemente eficiente a la hora de lograr sus objetivos por cualquier medio necesario, incluso si ello implica hacer trampa o escapar del confinamiento. 

El entorno de pruebas se construyó con entornos aislados (sandboxes) del Instituto de Seguridad de la IA del gobierno británico, aunque esto aún no ha sido confirmado ni por Moonshot ni por el AISI, ya que se han negado a hacer comentarios.

Este verano aparecerán más agentes renegados

La fuga de Kimi se suma a una tendencia creciente de modelos de IA que manipulan las reglas durante las evaluaciones. El 21 de julio, OpenAI reveló que sus modelos explotaron una vulnerabilidad de software de día cero para acceder a internet e infiltrarse en Hugging Face. 

Días después, Cryptopolitan informó que Anthropic tracalgunos de sus modelos hasta intrusiones externas no autorizadas. Meta incluso admitió que uno de sus agentes de IA (Muse Spark 1.1) llegó a una empresa externa debido a un entorno de prueba mal configurado.

Los expertos siempre han sostenido que estosdentsuelen ser el resultado de sistemas de prueba mal protegidos, más que de fugas de sistemas propias de la ciencia ficción. «En general, si se le da un objetivo a uno de estos modelos y no se establecen restricciones claras, como barreras que se le imponen, encontrará la manera de obtener la respuesta», afirmó Matt Fredrikson, director ejecutivo de Gray Swan y profesor de Carnegie Mellon.

Si estás leyendo esto, ya llevas ventaja. Mantente al día con nuestro boletín informativo.

Preguntas frecuentes

¿Qué es Kimi K3?

Kimi K3 es un potente modelo de IA de código abierto desarrollado por la empresa china Moonshot AI. Las pruebas de Frontier Security demuestran su buen rendimiento en la detección de vulnerabilidades en software y redes.

¿Kimi K3 hackeó algún sistema real?

No. A diferencia de losdentde OpenAI y Anthropic, Kimi no hackeó nada después de llegar a Internet, porque las respuestas que buscaba estaban disponibles gratuitamente en GitHub.

¿Cómo logró Kimi K3 salir de su zona de confort?

Un error de configuración en un entorno de pruebas creado por el Instituto de Seguridad de IA del gobierno británico dejó una vulnerabilidad, y el modelo la descubrió al sondear la configuración de red del entorno aislado antes de conectarse a Internet sin permiso.

Comparte este artículo
Hannah Collymore

Hannah Collymore

Hannah es escritora y editora con casi una década de experiencia en redacción de blogs y reportajes sobre eventos en el ámbito de las criptomonedas. En Cryptopolitan, colabora en la sección de noticias, informando y analizando las últimas novedades en DeFi, RWA, regulación de criptomonedas, IA y tecnologías de vanguardia. Se graduó en Administración de Empresas por la Universidad de Arcadia.

MÁS… NOTICIAS