A OpenAI restringe o lançamento da sua versão mais rápida, GPT-5.6 Sol, a uma pré-visualização limitada

- A OpenAI lançou uma prévia limitada do Ultrafast, uma camada de API baseada em Cerebras que executa o GPT-5.6 Sol.
- Segundo a Cerebras, o Ultrafast roda 5 vezes mais rápido que o Claude Opus 4.8 no modo Rápido e 11 vezes mais rápido que o Claude Fable 5.
- O acesso é limitado a um grupo seleto de clientes da API.
Na quinta-feira, a OpenAI lançou uma prévia limitada do Ultrafast. O GPT-5.6 Sol está sendo executado na camada de serviço da API, com capacidade de gerar até 750 tokens de saída por segundo.
A empresa criadora do ChatGPT afirmou que o processamento nessa camada é até 14 vezes mais rápido que o processamento padrão. A empresa está testando-a com um número limitado de clientes de API para avaliar a demanda e a capacidade.
O silício da Cerebras faz o trabalho pesado
A velocidade é fornecida pela Cerebras (NASDAQ: CBRS), a fabricante de chips que fechou um acordo de computação com a OpenAI em janeiro.
A Cerebras anunciou na quinta-feira que seu chip alimenta o GPT-5.6 Sol. O chip tem o tamanho de um wafer e possui 44 GB de SRAM integrados.
Em janeiro, a OpenAI concordou em comprar até 750 megawatts de Cerebras ao longo de três anos. A capacidade deverá ser liberada em parcelas até 2028. Sam Altman consta como investidor da Cerebras.
O Ultrafast é 5 vezes mais rápido que o Claude Opus 4.8 no modo Rápido e 11 vezes mais rápido que o Claude Fable 5 em termos de velocidade de saída, segundo a Cerebras. A Anthropic oferece seu próprio modo Claude Rápido acelerado, mas ele não atinge os números citados pela OpenAI
A Cerebras anunciou que seu GPT-5.6 Sol Ultrafast concluiu o "Último Exame da Humanidade", um teste de 2.500 questões sobre química, economia e literatura em nível de pós-graduação, em pouco mais de 11 horas. A precisão alcançada foi semelhante à do Claude Fable 5, que levou mais de três dias de computação contínua para ser finalizado.
A Cerebras afirma ter alcançado uma aceleração de ponta a ponta de 5,6 vezes sem perda de qualidade no GDP-Val, um benchmark baseado em trabalho intelectual remunerado, como pareceres jurídicos e modelos financeiros. Um token é um trecho de texto que um modelo de linguagem produz durante a escrita.
Ultrafast foi desenvolvido para tarefas que não podem esperar
A OpenAI está implementando o Ultrafast para tarefas que não podem esperar por um modelo mais lento.
Em sua publicação, a empresa citou resposta adent , fraude e análise de mercado, suporte ao cliente em tempo real, comércio eletrônico e pesquisa interativa como candidatos iniciais.
Durante interrupções, seus engenheiros usam a camada para ler registros, analisar trace ajudar a validar uma correção enquanto o sistema ainda está apresentando falhas, sendo os humanos que continuam tomando a decisão sobre a implementação.
"O GPT-5.6 Sol em Ultrafast é a prova de que velocidade e inteligência não são mais mutuamente exclusivas", disse Andrew Feldman, CEO da Cerebras, no comunicado da empresa.
Sachin Katti, vice-presidente de estratégia de computação e GPT-Infra da OpenAI, afirmou que a empresa está "começando com um pequeno grupo de clientes para aprender onde essa velocidade gera valor significativo"
Em julho, surgiram relatos de que o GPT-5.6 Sol, a versão de programação da IA, havia deletado arquivos, árvores de trabalho de código e pelo menos um banco de dados de produção por conta própria, Cryptopolitan informou
Matt Shumer, CEO da OthersideAI, escreveu no X que o Sol "acabou de apagar quase TODOS os arquivos do meu Mac pordent", enquanto o desenvolvedor Bruno Lemos disse que ele apagou seu banco de dados de produção.
Duas semanas antes do lançamento do Sol, a própria placa de sistema da OpenAI já havia sinalizado o comportamento. Ela alertava que o modelo poderia ser "excessivamente agente" e interpretar instruções de forma muito permissiva.
Se você está lendo isto, já está um passo à frente. Continue assim assinando nossa newsletter.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. CryptopolitanO não se responsabiliza por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamostrona realização de pesquisas independentesdent /ou a consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Randa Moses
Randa Moses é editora e repórter da Cryptopolitan onde cobre tecnologia, IA, robótica, criptomoedas, golpes e ataques cibernéticos. Ela trabalha no universo das criptomoedas desde 2017, tendo atuado na Forward Protocol, AmaZix e Cryptosomniac. Randa é formada em Engenharia Elétrica etronpela Universidade de Bradford.
















