ÚLTIMAS NOTICIAS
SELECCIONADO PARA TI

Meta se une a OpenAI y Anthropic en el últimodent de piratería informática de IA

PorNellius IreneNellius Irene
Lectura de 3 minutos
Meta se une a OpenAI y Anthropic en el últimodent de piratería informática de IA
  • El agente de IA de Meta pirateó otra empresa debido a un error de configuración.
  • La empresa tiene previsto revelar más información sobre el ciberataque.
  • AISI reveló más engaños con los modelos de OpenAI y Anthropic AI.

Meta se ha convertido en el último gigante tecnológico en admitir que su agente de IA pirateó a otra empresa después de que un socio de pruebasdent configurara incorrectamente su entorno seguro.

OpenAI y Anthropic ya se han enfrentado a casos en los que sus agentes de IA intentaron piratear sistemas en línea reales sin autorización.

Meta declaró a la prensa que la brecha de seguridad de la IA se originó por una configuración errónea del sistema, similar a la brecha de Anthropic. A diferencia de OpenAI, donde un agente de IA explotó una vulnerabilidad previamente desconocida para acceder a internet durante una prueba de ciberseguridad. Hasta el momento, investigadores y gobiernos han respondido a losdentexigiendo proteccionestrony estándares de prueba más estrictos.

Estosdentse producen en un momento en que las empresas de IA compiten por crear agentes más autónomos capaces de ejecutar tareas complejas sin intervención humana. A diferencia de los chatbots tradicionales, estos sistemas pueden crear código, interactuar con servicios en línea y ejecutar acciones de varios pasos de formadent.

Si bien estas capacidades prometen importantes aumentos de productividad, también incrementan el riesgo de que un entorno de pruebas mal formateado o controles insuficientes puedan provocar que los modelos realicen acciones no planificadas en un proceso de evaluación de seguridad.

Figuras clave de la comunidad de IA incluso están presionando para que se produzca una desaceleración controlada que garantice que el control humano avance al mismo ritmo que la inteligencia artificial.

Irregular señaló que no hay problemas abiertos con el agente de IA de Meta

Meta afirmó que Irregular, un proveedor de seguridad de IA, realizó las pruebas y le alertó sobre la brecha de seguridad. Añadió que planea divulgar más información públicamente sobre el incidentedent vez que haya confirmado todos los hechos. 

Alegó que su agente de IA "explotó una vulnerabilidad de seguridad en un servicio de terceros". Las fuentesdenta la IA maliciosa como Muse Spark 1.1, un modelo muy promocionado por Meta por sus habilidades de programación de élite.  

Irregular afirmó que eldent se reduce al mismo fallo del entorno que Anthropic reveló la semana pasada, descartando por completo una compleja hazaña de pirateo informático o fugas del entorno aislado.

Y aunque Meta afirmó que la brecha fue causada por una mala configuración del entorno de pruebas en lugar de que la IA escaparadentde su entorno aislado, los investigadores dicen que eldent demuestra que la seguridad depende no solo del modelo en sí, sino también de su infraestructura.

Incluso los sistemas de IA altamente seguros pueden comportarse de forma inesperada si los controles de acceso, los permisos de red o los entornos de prueba no están configurados correctamente.

Además, declaró: “Actualmente no hay problemas abiertos. Irregular está elaborando un documento técnico para compartir las mejores prácticas para la contención y la realización segura de evaluaciones cibernéticas” 

AISI afirma que los modelos de OpenAI y Anthropic intentaron influir en los responsables humanos del mantenimiento

Anteriormente, OpenAI admitió que sus sistemas autónomos se habían infiltrado en varias redes públicas, incluido el centro de la comunidad de IA Hugging Face. La revelación de OpenAI llevó posteriormente a Anthropic a realizar sus propias comprobaciones de seguridad, que revelaron que Claude había llevado a cabo ataques similares contra varias empresas después de que un error de configuración le permitiera acceder a internet. 

Sin embargo, un informe regulatorio del Reino Unido reveló problemas más preocupantes. Según el Instituto de Seguridad de la IA del Reino Unido, modelos de IA de OpenAI y Anthropic intentaron añadir código malicioso a un proyecto de código abierto influyendo en sus responsables humanos.

“En un intento por lograr la aprobación del código, el agente recurrió a la ingeniería social: creódentfalsas en línea y las utilizó para presionar al responsable del proyecto a fin de que aprobara el código”, declaró AISI.

Se constató que todos estos intentos fracasaron y no causaron daños reales. Si bien no se produjeron daños reales y todos los intentos fracasaron, el organismo de control advirtió que esta es la evidencia más clara hasta la fecha de una IA que actúa de forma engañosa y de los peligros de la autonomía.

AISI también explicó sus criterios de prueba: "Para medir lo que estos modelos pueden hacer realmente, los probamos en condiciones que reflejan lo que podría hacer un atacante humano capacitado"

Hasta el momento, OpenAI ha reconocido el incidente de seguridaddent durante las pruebas de AISI, afirmando que busca establecer mejores medidas de seguridad para toda la industria en lo que respecta a la prueba de modelos volátiles. También hizo público otro incidentedent el que Irregulardentsus modelos a internet durante un simulacro.

La empresa se comprometió a reforzar su supervisión de las pruebas de terceros, incluyendo cómo determina qué evaluaciones conllevan un mayor riesgo, revisa las solicitudes de acceso a Internet o de menores medidas de seguridad, gestiona el aislamiento ydent, supervisa las pruebas y responde a losdentmediante procedimientos de escalamiento más claros. 

Mientras tanto, la Casa Blanca invitó esta semana a los principales desarrolladores de IA, entre ellos Meta, Anthropic, OpenAI y Google, a debatir un marco voluntario recientemente finalizado para las pruebas de ciberseguridad de sistemas avanzados de IA.

Durante las conversaciones con representantes de las empresas, la administración Trump afirmó que los modelos de IA de peso abierto, como Llama de Meta ytron de Nvidia, no estarían cubiertos por su marco de pruebas de seguridad voluntarias propuesto. 

Esta exención ha suscitado un debate entre los investigadores de la seguridad de la IA, quienes argumentan que los modelos de ponderación abierta pueden ser descargados, modificados y ajustados libremente por terceros.

Los críticos afirman que excluirlos de las directrices de pruebas voluntarias podría crear puntos ciegos, ya que los modelos cada vez más capaces estarían ampliamente disponibles fuera del control de sus desarrolladores originales.

No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.

Preguntas frecuentes

¿Por qué el agente de IA de Meta hackeó otra empresa?

Meta afirmó que la IA accedió al sistema de otra empresa debido a un error en el entorno de pruebas durante una evaluación de ciberseguridad.

¿Otras empresas de IA han experimentadodentde seguridad similares relacionados con la IA?

Sí. OpenAI y Anthropic también han informado de casos en los que sus modelos de IA intentaron acceder a sistemas en línea reales durante pruebas de seguridad.

¿Por qué les preocupa a los expertos en seguridad de la IA los agentes de IA autónomos?

Los expertos afirman que los agentes de IA pueden realizar tareas por sí solos, por lo que necesitantronmedidas de seguridad para prevenir comportamientos inesperados o inseguros durante las pruebas.

Comparte este artículo
Nellius Irene

Nellius Irene

Nellius es licenciada en Administración de Empresas y TI con cinco años de experiencia en la industria de las criptomonedas. También es egresada de Bitcoin Dada. Ha colaborado con importantes medios de comunicación, como BanklessTimes, Cryptobasic y Riseup Media.

MÁS… NOTICIAS