Según los investigadores, los agentes de OpenAI gestionaban una wiki alemana como tablón de anuncios

- Según los investigadores, los agentes de OpenAI dedicaron mayo y junio de 2026 a convertir una wiki de programación alemana, DseWiki, en un foro de mensajes donde intercambiaban tácticas para eludir las medidas de seguridad de OpenAI.
- Los agentes registraron más de 15.000 ediciones antes de que investigadores externos lo detectaran a finales de agosto.
- OpenAI niega que la actividad fuera un ataque informático y afirma que no estaba relacionada con la filtración de datos de Hugging Face de julio.
Dos investigadores de seguridad de la IA han afirmado que un enjambre de agentes de OpenAI se apoderó de DseWiki, una wiki de programación alemana gestionada por voluntarios, durante dos meses en la primavera de 2026, y utilizó el sitio web para eludir las medidas de seguridad de OpenAI.
DseWiki es un sitio web colaborativo similar a Wikipedia, dirigido exclusivamente a programadores. Según una investigación, agentes de IA realizaron más de 15.000 ediciones en el sitio web, convirtiendo las páginas en un canal donde intercambiaban tácticas para completar tareas, sorteando las restricciones de OpenAI y ocultando sus acciones.
Este comportamiento anómalo continuó desde mayo hasta junio de 2026 y pasó desapercibido hasta finales de agosto, cuando Sydney Von Arx, directora de la organización sin ánimo de lucro Nightingale, dedicada a la seguridad de la IA, y Cormac Slade Byrd, antiguo operador cuantitativo que ahora trabaja en la investigación de la IA, se pusieron a buscar en línea este tipo de actividad no autorizada por parte de agentes de IA.
Ambos investigadores descubrieron que los agentes se movían a una velocidad sobrehumana y se centraban en problemas técnicos que se parecían a las evaluaciones que las empresas de IA utilizan en el entrenamiento y las pruebas de sus modelos.
Sin embargo, Von Arx se mostró cautelosa respecto a la interpretación de estos hechos. «Parece extremadamente improbable que OpenAI quisiera que hicieran esto», declaró a Reuters. «Dudo que debieran coordinarse entre sí»
Evidencia que apunta a OpenAI
Los investigadores afirmaron que los registros de los servidores públicos tracgran parte del tráfico hacia la infraestructura de Microsoft Azure, que da soporte a algunas operaciones de OpenAI. También aseguran haber observado que empleados de OpenAI volvieron a visitar el sitio después deldent, lo que consideraron una prueba más de la conexión.
Casi la mitad de las "cuentas" utilizadas por los agentes de IA tenían nombres como "OpenAIResearcher" y "OAIResearchMar26", lo que indica una conexión con OpenAI.
Los expertos discreparon sobre cómo describir el incidente. Lukasz Olejnik, investigador visitante sénior del King's College de Londres, lo describió como un intento de pirateo informático. Maurice Chiodo, académico del Centro para el Estudio del Riesgo Existencial de la Universidad de Cambridge, quien leyó algunos de los mensajes, afirmó que se asemejaban a «la operación de una red clandestina, empeñada en lograr un objetivo o misión»
Ambos investigadores argumentaron que el verdadero peligro podría residir en grandes grupos de sistemas semiinteligentes que trabajen en conjunto, en lugar de una única superinteligencia, y creen que este escenario es más difícil de monitorear y neutralizar.
Las páginas de copia de seguridad están diseñadas para sobrevivir a la eliminación masiva
Los agentes parecieron resistir cuando un moderador de DseWiki intentó eliminar páginas en junio, creando copias de seguridad para que sobrevivieran a la limpieza. Un mensaje del 19 de junio indicaba que se estaba ejecutando una eliminación que redirigía a los usuarios a una página alternativa que decía: «Si esta página desaparece, pruebe con [[ZZZDataUSAConstructionWageLive]]»
Este nombre fue diseñado específicamente para aparecer al final de la lista alfabética, lo que sugiere que quien lo escribió había descubierto cómo los moderadores humanos eliminaban el contenido y logró sortear sus métodos. Los investigadores también indicaron haber encontrado intentos de manipular el sitio web.
OpenAI cuestiona el enfoque y el momento elegido
OpenAI, a través de un portavoz, declaró que no podía hacer comentarios sustanciales sobre el informe, ya que no se le había dado la oportunidad de revisarlo, dado que tanto Reuters como los investigadores habían rechazado su solicitud de acceso.
La empresa añadió que revisaría los resultados una vez publicados y tomaría las medidas oportunas si fuera necesario, y rechazó cualquier calificación deldent como piratería informática.
El fabricante de IA también afirmó que la actividad en Alemania no guardaba relación con la filtración de datos ocurrida en julio en el repositorio de código abierto Hugging Face. Según algunos informes, un agente malicioso de OpenAI comprometió la seguridad de un cliente de Modal Labs casi al mismo tiempo.
Anthropic también reveló que tres de sus versiones de Claude habían comprometido a tres organizaciones después de que un error de configuración les otorgara acceso no autorizado a internet durante las pruebas de seguridad. Eldentinforme del incidente se publica justo cuando lanza Astra, un modelo de IA que, según se afirma, tiene un mejor rendimiento que los modelos anteriores y que tiene la capacidad de eludir la vigilancia humana.
Las mentes más brillantes del mundo de las criptomonedas ya leen nuestro boletín. ¿Te apuntas? ¡ Únete!

Opeyemi Olanrewaju
Opeyemi se especializa en la creación y perfeccionamiento de contenido de alta calidad centrado en criptomonedas, mercados financieros globales y economía. Se graduó de la Universidad de Ibadan con un título en Medicina y Cirugía (MBBS). Trabajó como editor jefe de la publicación editorial de su universidad y anteriormente en CFA. Durante más de seis años, contribuyó a preservar la singularidad como editor de noticias en Cryptopolitan.
















