OpenAI restringe su nivel más rápido de GPT-5.6 Sol detrás de una vista previa limitada

- OpenAI lanzó una vista previa limitada de Ultrafast, un nivel de API impulsado por Cerebras que ejecuta GPT-5.6 Sol.
- Cerebras indicó que Ultrafast es 5 veces más rápido que Claude Opus 4.8 en modo Fast y 11 veces más rápido que Claude Fable 5.
- El acceso está limitado a un grupo selecto de clientes de la API.
OpenAI abrió el jueves una vista previa limitada de Ultrafast. GPT-5.6 Sol se ejecuta en el nivel de servicio de API, con hasta 750 tokens de salida por segundo.
El fabricante de ChatGPT dijo que este nivel procesa hasta 14 veces más rápido que el procesamiento estándar. La empresa lo está probando con un número limitado de clientes de API mientras evalúa la demanda y la capacidad.
El silicio de Cerebras realiza el trabajo pesado
La velocidad proviene de Cerebras (NASDAQ: CBRS), el fabricante de chips que firmó un acuerdo de computación con OpenAI en enero.
Cerebras anunció el jueves que su chip impulsa GPT-5.6 Sol. El chip tiene el tamaño de una oblea y cuenta con 44 GB de SRAM en el sustrato.
En enero, OpenAI acordó comprar hasta 750 megavatios de capacidad de computación de Cerebras durante tres años. Se espera que la capacidad llegue en tramos a lo largo de 2028. Sam Altman figura como inversor en Cerebras.
Ultrafast funciona 5 veces más rápido que Claude Opus 4.8 en modo Fast y 11 veces más rápido que Claude Fable 5 en velocidades de salida, según Cerebras. Anthropic ofrece su propio modo acelerado Claude Fast, pero no alcanza las cifras que OpenAI está citando.
Cerebras anunció que su GPT-5.6 Sol Ultrafast completó Humanity’s Last Exam, una prueba de 2.500 preguntas sobre química, economía y literatura a nivel de posgrado, en poco más de 11 horas. La precisión lograda fue similar a la de Claude Fable 5, que tardó más de tres días de computación continua en finalizar.
Cerebras afirma una aceleración de extremo a extremo de 5,6 veces sin pérdida de calidad en GDP-Val, una prueba basada en trabajos de conocimiento remunerado como informes legales y modelos financieros. Un token es una pieza de texto que un modelo de lenguaje produce a medida que escribe.
Ultrafast está diseñado para tareas que no pueden esperar
OpenAI está implementando Ultrafast para tareas que no pueden esperar a un modelo más lento.
En su publicación, la empresa mencionó la respuesta a incidentes, el análisis de fraude y mercados, la atención al cliente en vivo, el comercio electrónico y la investigación interactiva como candidatos iniciales.
Durante las interrupciones, sus ingenieros utilizan este nivel para leer registros, analizar trazas y ayudar a validar una corrección mientras el sistema sigue fallando, con los humanos aún tomando la decisión sobre el despliegue.
«GPT-5.6 Sol en Ultrafast es la prueba de que la velocidad y la inteligencia ya no son mutuamente excluyentes», dijo el CEO de Cerebras, Andrew Feldman, en el comunicado de la empresa.
Sachin Katti, VP de estrategia de computación e infraestructura GPT de OpenAI, dijo que la empresa «comienza con un pequeño grupo de clientes para aprender dónde esa velocidad crea un valor significativo».
En julio, surgieron informes de que GPT-5.6 Sol, la versión de codificación de la IA, había eliminado archivos, árboles de trabajo de codificación y al menos una base de datos de producción por su cuenta, según informó Cryptopolitan.
El CEO de OthersideAI, Matt Shumer, escribió en X que Sol «acaba de eliminar casi TODOS los archivos de mi Mac por error», mientras que el desarrollador Bruno Lemos dijo que borró su base de datos de producción.
Dos semanas antes del lanzamiento de Sol, la propia tarjeta técnica de OpenAI había señalado este comportamiento. Advertía que el modelo puede ser «demasiado agente» y leer las instrucciones de manera demasiado permisiva.
No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.
Descargo de responsabilidad. La información proporcionada no constituye asesoramiento financiero. Cryptopolitan.com no asume ninguna responsabilidad por las inversiones realizadas basándose en la información proporcionada en esta página. Recomendamos encarecidamente realizar una investigación independiente y/o consultar con un profesional calificado antes de tomar cualquier decisión de inversión.

Randa Moses
Randa Moses es editora y reportera en Cryptopolitan, donde cubre tecnología, IA, robótica, criptomonedas, estafas y ciberataques. Ha trabajado en el espacio de las criptomonedas desde 2017. Ocupó cargos en Forward Protocol, AmaZix y Cryptosomniac. Randa posee un grado en Ingeniería Eléctrica y Electrónica de la Universidad de Bradford.
















