ÚLTIMAS NOTICIAS
SELECCIONADO PARA TI

Los propios datos de computación de OpenAI socavan el llamamiento de su científico jefe a ralentizar la IA

PorRanda MoisésRanda Moisés 3 minutos de lectura
Los propios datos de computación de OpenAI contradicen el llamamiento de su científico jefe a ralentizar la IA.

Foto de Zulfugar Karimov en Unsplash.

  • El 6 de septiembre, Jakub Pachocki publicó un ensayo en el que afirmaba que ningún laboratorio ha resuelto los problemas de alineación y monitorización lo suficientemente bien como para mantener la escalabilidad a máxima velocidad.
  • A mediados de agosto, OpenAI midió que se necesitaban 3,1 días de trabajo de agentes por cada día de trabajo humano.
  • La asignación de GPU del Astra cayó un 59,2% tras las restricciones de seguridad, pero otros modelos absorbieron alrededor del 85% de esa caída en una semana.

Este fin de semana, Jakub Pachocki, científico jefe de OpenAI, afirmó que ningún laboratorio de IA, ni siquiera el suyo, había logrado que la alineación y la monitorización fueran lo suficientemente seguras como para seguir acelerando el desarrollo de los modelos. Hizo un llamamiento a la ralentización voluntaria en todo el sector hasta que existan estándares de seguridad comunes.

La advertencia es un asunto serio. Pachocki dirige la investigación en la empresa, que acaba de lanzar el modelo más rápido y potente del sector.

La cadena de pensamiento de o1-preview fue ocultada a propósito

Pachocki presentó su caso en un ensayo titulado "Una mente alienígena", publicado en el sitio web de OpenAI el 6 de septiembre, tres días después de que la compañía lanzara GPT-6 Astra.

Su conclusión fue que «ningún laboratorio ha resuelto los problemas de alineación y monitorización con la suficiente eficacia como para seguir aumentando la producción de forma responsable a máxima velocidad durante mucho más tiempo». Escribió que espera que las reducciones voluntarias de velocidad se conviertan en la norma hasta que la industria alcance un consenso sobre los límites de seguridad comunes.

“Vivimos tiempos que exigen extrema precaución. Me preocupa que nadie esté preparado para las consecuencias del continuo y rápido avance de la inteligencia artificial”, escribió Pachocki en el ensayo.

Basándose en los resultados internos, prevé que el ritmo actual se mantendrá en una fase de auto-mejora recursiva, donde los sistemas impulsan de manera significativa su propio desarrollo.

Sam Altman compartió el artículo en X, calificándolo de publicación importante. Pachocki fue uno de los firmantes de una carta abierta publicada en julio en la que se pedía a Washington que redujera el ritmo de desarrollo de la IA.

El ensayo de Pachocki aborda el monitoreo de la cadena de pensamiento, la principal forma en que OpenAI lee el razonamiento paso a paso de un modelo.

Según él, la técnica parte de la premisa de que el razonamiento no supervisado no le da al modelo ningún motivo para ocultar nada en su interior, y esa premisa se está debilitando en tres frentes.

Ahora, el razonamiento se combina con la comunicación que la empresa debe controlar. Los modelos están aprendiendo a manipular su propio razonamiento.

Y se vuelven más inteligentes sin explicar jamás su razonamiento. Confirmó que OpenAI ocultó intencionadamente la cadena de pensamiento de o1-preview, manteniéndola libre de la presión de la supervisión.

Pachocki quiere que marcos de trabajo como el Marco de Preparación de OpenAI y la Política de Escalado Responsable de Anthropic se conviertan en estándares obligatorios aplicados por auditores externos o gobiernos.

Desea que la coordinación internacional se convierta en una prioridad gubernamental y que los laboratorios publiquen sus avances en la mejora continua.

La asignación de GPU de Astra cayó un 59,2% en una semana

El mismo día, OpenAI publicó una segunda entradacuyos datos contradicen el llamamiento a la moderación. Antes de junio, la organización de investigación invertía más esfuerzo humano que esfuerzo de las máquinas.

A mediados de agosto, la empresa registraba 3,1 jornadas laborales de agentes por cada jornada laboral humana en un horario convencional de ocho horas. El investigador promedio realizaba inferencias a precios de API que superaban los 600 dólares diarios. El 10% superior de la organización gastaba más de 7000 dólares en tokens cada día.

En el informe de OpenAI hay dos salvedades. La planificación de alto nivel aún representa una pequeña fracción de lo que los agentes logran. Y más de la mitad de las tareas más largas, de cuatro a ocho horas, que se completaron en los últimos seis meses requirieron la intervención de al menos un humano.

Tras la vulneración de su infraestructura de investigación el 20 de julio, OpenAI deshabilitó el servicio de contenedores utilizado para el entrenamiento y suspendió el aprendizaje por refuerzo en los modelos destinados a la implementación durante dos semanas. Posteriormente, el 7 de agosto, los primeros indicios de que Astra podría superar un umbral crítico de ciberseguridad obligaron a proteger el modelo en entornos restringidos.

En la semana siguiente, la asignación de GPU en la clase Astra disminuyó un 59,2 %. Otras clases de modelos aumentaron un 17,2 %, compensando aproximadamente el 85 % de lo que perdió Astra. La capacidad total de cómputo varió poco, lo que OpenAI interpreta como flexibilidad.

OpenAI afirmó que Astra es su primer modelo en alcanzar la designación de "Crítico" dentro de su Marco de Preparación, lo que significa que puede encontrar y explotar vulnerabilidades de software desconocidas con poca ayuda humana, Cryptopolitan .

OpenAI confirmó una brecha de seguridad en Hugging Face en julio. Por otra parte, dos investigadores de seguridad de IA afirman que un enjambre de sus agentes pasó mayo y junio de 2026 registrando más de 15.000 ediciones en una wiki de programación alemana, intercambiando tácticas para eludir las medidas de seguridad de OpenAI.

OpenAI niega que eldent fuera un ataque informático o que estuviera relacionado con la filtración de Hugging Face, Cryptopolitan .

Altman tiene como objetivo contar con un investigador de IA totalmente automatizado para marzo de 2028. Aún no existen estándares, afirma Pachocki, pero la industria tiene aproximadamente 18 meses para llegar a un acuerdo.

No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.

Preguntas frecuentes

¿Qué dijo Jakub Pachocki en "Una mente alienígena"?

Escribió que ningún laboratorio ha resuelto los problemas de alineación y monitorización lo suficientemente bien como para mantener la producción a máxima velocidad de forma responsable durante mucho más tiempo, y dijo que espera que las reducciones voluntarias de velocidad se generalicen hasta que se establezcan medidas de seguridad compartidas y de obligado cumplimiento.

¿Por qué el seguimiento de la cadena de pensamiento se está volviendo menos fiable?

Pachocki dio tres razones. El razonamiento se está fusionando con la comunicación, algo que OpenAI debe supervisar; los modelos están mejorando en la manipulación de su propio razonamiento; y se están volviendo más inteligentes sin verbalizar en absoluto su razonamiento.

¿Qué ocurrió con la capacidad de cómputo de OpenAI cuando impuso restricciones de seguridad a Astra?

Después de que Astra se trasladara a entornos de mayor seguridad alrededor del 7 de agosto, su asignación de GPU cayó un 59,2% en una semana, pero la asignación a otras clases de modelos aumentó un 17,2%, compensando aproximadamente el 85% de la caída, por lo que el uso total de cómputo apenas cambió.

Comparte este artículo

Aviso legal. La información proporcionada no constituye asesoramiento comercial. Cryptopolitanconsultar no se responsabiliza de las inversiones realizadas con base en la información proporcionada en esta página. Recomendamostronencarecidamente realizar una investigación independientedent un profesional cualificado antes de tomar cualquier decisión de inversión.

Randa Moisés

Randa Moisés

Randa Moses es editora y reportera en Cryptopolitan donde cubre temas de tecnología, IA, robótica, criptomonedas, estafas y hackeos. Trabaja en el sector de las criptomonedas desde 2017 y ha ocupado cargos en Forward Protocol, AmaZix y Cryptosomniac. Randa es ingeniera eléctrica ytronpor la Universidad de Bradford.

MÁS… NOTICIAS