ÚLTIMAS NOTICIAS
SELECCIONADO PARA TI

OpenAI interrumpe la campaña vinculada a Moonshot mientras se intensifica la guerra de destilación de IA

PorNellius IreneNellius Irene 3 min de lectura
  • OpenAI afirma haber identificado esfuerzos de destilación de datos asociados con Moonshot.
  • Ha suspendido algunas cuentas vinculadas a dicha campaña de destilación.
  • Anthropic también reportó que Moonshot había dirigido sus ataques contra sus modelos Claude.

OpenAI ha presentado acusaciones de raspado de datos contra su competidor chino, Moonshot AI. Conectó una enorme oleada de actividades de sondeo, diseñadas para descifrar cómo razonan sus modelos ante problemas complejos, con miles de intentos provenientes de usuarios afiliados a Moonshot.

A partir de la primera semana de julio, la campaña coordinada asociada a Moonshot aumentó hasta 16.000 solicitudes de más de 4.000 usuarios en solo dos días, reveló OpenAI. El creador de ChatGPT terminó mapeando más actividad relacionada que involucraba a un grupo de más de 15.000 usuarios, toda la cual fue completamente interrumpida antes del 28 de julio.

Según el análisis de la empresa, la campaña no provocó ninguna violación de la base de datos, ruptura del cifrado ni exposición de los chats almacenados de los usuarios. Sin embargo, los atacantes aprovecharon las indicaciones y manipulaciones del modelo, lo que les permitió duplicar visiblemente capacidades de razonamiento prohibidas mediante una operación elaborada y a gran escala que violaba los términos de servicio.

OpenAI afirma haber implementado más medidas de seguridad para prevenir la destilación

Según OpenAI, esta detectó e interrumpió algunas operaciones en las que los usuarios intentaron robar lógica oculta transfiriendo información de razonamiento cifrada entre diferentes chats y luego descifrándola en otro chat.

La mayoría de esas operaciones estaban vinculadas a Moonshot. Simultáneamente, otros investigadores de terceros reportaron vulnerabilidades similares a la empresa, incluidos problemas de cruce entre modelos y compactación de datos.

Hasta ahora, el desarrollador de ChatGPT ha calificado el evento reciente como "destilación adversarial" y advirtió que destilar la lógica podría permitir a los oponentes imitar tecnologías avanzadas.

Añadió que un proceso de destilación a gran escala podría acortar drásticamente el tiempo necesario para desarrollar una capacidad avanzada de IA sin ningún compromiso con la seguridad y la alineación.

Hasta ahora, para abordar la tendencia de la destilación, OpenAI ha implementado sanciones a las cuentas, fortalecido la infraestructura y buscado asociaciones.

Además, incluso ha suspendido cuentas sospechosas, reforzado el proceso de registro y la seguridad del back-end, y ampliado su monitoreo de la comunidad de usuarios.

Adicionalmente, implementó protecciones más robustas contra el razonamiento oculto que afectan a todos los usuarios, espacios de trabajo, organizaciones empresariales y arquitecturas de modelos.

Caroline Zier, responsable de iniciativas estratégicas de política de seguridad nacional en OpenAI, añadió que continuarán invirtiendo en protecciones más sólidas. Declaró: 'Nuestra preocupación es sobre la violación de nuestros términos de servicio, no sobre los modelos abiertos o la destilación legítima'.

Por qué la destilación de modelos de IA se está convirtiendo en una preocupación mayor

La destilación de modelos permite a los desarrolladores utilizar las salidas de un sistema de IA más capaz para mejorar o replicar el rendimiento de otro modelo.

Aunque la destilación legítima puede utilizarse para crear sistemas más pequeños y eficientes, OpenAI sostiene que la extracción a gran escala no autorizada puede dar a los competidores acceso a capacidades que requirieron recursos significativos para desarrollar.

La empresa señaló que la última campaña era particularmente preocupante porque los actores no estaban simplemente utilizando ChatGPT para tareas ordinarias. En cambio, supuestamente diseñaron flujos de trabajo automatizados para consultar repetidamente los modelos y transferir respuestas útiles a otros sistemas.

Al recopilar suficientes salidas, los atacantes podrían potencialmente reproducir aspectos del razonamiento, la programación y las capacidades de resolución de problemas de un modelo sin acceder directamente a sus pesos subyacentes o infraestructura.

Los informes de OpenAI destacan un desafío creciente para las empresas de IA, ya que modelos cada vez más capaces se vuelven ampliamente accesibles a través de APIs y productos de consumo. Los proveedores deben equilibrar el acceso generalizado a sus sistemas con salvaguardas diseñadas para prevenir la extracción sistemática de capacidades propietarias.

Anthropic también identificó la campaña de destilación de Moonshot

En los últimos meses, Anthropic también descubrió y detuvo varias campañas cibernéticas en las que actores maliciosos tomaron como objetivo a Claude.

Estos perpetradores incluían grupos de inteligencia presuntamente respaldados por estados, hackers motivados financieramente y activistas políticos, con los incidentes ocurriendo entre diciembre de 2025 y agosto de 2026.

Sus ataques específicos tenían como objetivo extraer las competencias de alto valor de Claude: su deducción lógica, codificación, evaluación de datos y flujos de trabajo de agentes automatizados.

Según se informa, cinco procesos diferentes de destilación dieron lugar a casi 200 millones consultas ilegales. La mayor parte de las consultas de destilación provino de una campaña de Alibaba, que Anthropic caracterizó como el esfuerzo de recopilación de datos más grande en la historia de la corporación. Esta campaña en particular generó 151 millones de consultas registradas de mayo a julio de 2026, alcanzando un pico de casi 3 millones por día.

Una segunda campaña de Moonshot AI supuestamente reenvió consultas directamente desde el ejército chino a Anthropic. En un período de 10 días, la empresa registró casi 300.000 consultas provenientes de 5.000 cuentas, la mayoría de las cuales estaban dirigidas al modelo Opus.

Moonshot ha recibido considerable atención en Washington debido al rápido ritmo con el que ha superado a sus rivales estadounidenses.

Aunque Pekín ya ha ignorado las acusaciones previas de Silicon Valley y la administración Trump sobre sus actividades de recopilación de datos, ha amenazado con tomar contramedidas en caso de que Washington imponga sanciones.

Si estás leyendo esto, ya vas por delante. Mantente así con nuestro boletín.

Preguntas frecuentes

¿Qué es la destilación de modelos de IA?

La destilación de modelos de IA es un proceso mediante el cual los desarrolladores utilizan las salidas de un modelo de IA más capaz para entrenar o mejorar otro modelo. OpenAI indica que la destilación no autorizada a gran escala puede permitir que otros repliquen capacidades avanzadas sin acceder directamente a los sistemas subyacentes del modelo original.

¿La campaña de Moonshot AI vulneró los sistemas de OpenAI?

OpenAI afirmó que la campaña no comprometió sus bases de datos, no rompió el cifrado ni expuso los chats de usuarios almacenados. En cambio, la empresa indicó que los usuarios recurrieron a repeticiones de prompts y manipulación del modelo para extraer información sobre las capacidades de razonamiento de sus modelos.

¿Cuántas consultas asoció Anthropic con la campaña de Moonshot AI?

Anthropic señaló que una campaña vinculada a Moonshot generó casi 300.000 consultas desde aproximadamente 5.000 cuentas durante 10 días, siendo la mayoría de las consultas dirigidas a su modelo Claude Opus.

Comparte este artículo
Nellius Irene

Nellius Irene

Nellius es graduada en Administración de Empresas y Tecnología de la Información con cinco años de experiencia en la industria de las criptomonedas. También es egresada de Bitcoin Dada. Nellius ha contribuido a publicaciones mediáticas líderes, incluyendo BanklessTimes, Cryptobasic y Riseup Media.

MÁS … NOTICIAS