ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

OpenAI lança chip Jalapeño com grande impacto no Nvidia GB300

PorHannah CollymoreHannah Collymore 2 minutos de leitura
OpenAI lança chip Jalapeño com grande impacto no Nvidia GB300
  • A OpenAI divulgou na terça-feira os primeiros resultados de benchmark para o Jalapeño, o seu chip de inferência desenvolvido pela Broadcom.
  • A empresa afirmou que o chip oferece até 1,9 vezes mais desempenho por watt e até 3,6 vezes menos latência do que os sistemas GB200 e GB300 da Nvidia em três modelos abertos.
  • O chip destina-se exclusivamente ao uso interno da OpenAI e será implementado em pequenos volumes até ao final de 2026.

A OpenAI publicou os seus primeiros resultados de benchmark para o Jalapeño, o seu chip de inferência desenvolvido internamente em parceria com a Broadcom.

A empresa afirma que o chip realiza mais trabalho de IA por watt e devolve respostas mais rapidamente do que os sistemas de rack Nvidia GB200 e GB300 com os quais foi comparado.

Qual o desempenho do novo chip da OpenAI?

A OpenAI publicou os resultados dos testes de desempenho do seu novo chip de IA próprio, chamado Jalapeño. O chip foi testado no InferenceX, um benchmark público da SemiAnalysis que mede o desempenho completo de um pedido de IA, e comparado com o GPT-OSS 120B da OpenAI, o R1 670B da DeepSeek e o Kimi K2.5 1T da Moonshot AI.

A OpenAI afirmou que o seu novo chip realizou 1,5 a 1,9 vezes mais trabalho por unidade de eletricidade do que os outros sistemas com os quais foi testado. Respondeu também a pedidos de 1,7 a 3,6 vezes mais rápido.

Para as tarefas mais práticas e que exigem muita interação, a diferença aumentou para entre 2,1 e 4,1 vezes.

O vice-dentde hardware da OpenAI, Richard Ho, disse aos jornalistas que o chip processa mais tarefas em simultâneo e também responde mais rapidamente, algo que a maioria dos chips não consegue fazer ao mesmo tempo.

Os pontos de comparação foram os superchips GB200 e GB300 da Nvidia, que representavam os melhores resultados já registados pela InferenceX até então. No maior modelo testado, o Kimi K2.5, a OpenAI afirmou que o Jalapeño atingiu um desempenho máximo por watt aproximadamente 1,5 vezes superior e uma latência 3,4 vezes inferior.

Não existe um mercado de aluguer, nenhum tipo de instância e nenhum plano para vender o Jalapeno, e quando questionado se a OpenAI ofereceria o chip a outros, Ho disse que a empresa está "a lutar para ter poder computacional suficiente" para as suas próprias necessidades.

A OpenAI tem o orçamento e o espaço físico, mas atualmente está limitada pela energia do data center, e não pelo orçamento ou espaço físico, o que faz com que a métrica que realmente importa seja a quantidade de tokens por megawatt.

A inferência é executada continuamente no ChatGPT e na API, pelo que a redução do consumo de energia de cada token resulta em ganhos significativos na escala em que a OpenAI opera. O chip tem uma potência nominal de 700 watts, mas manteve-se nos 550 watts ou menos nos testes de carga de trabalho.

O chip enquadra-se no acordo assinado entre a OpenAI e a Broadcom em outubro de 2025 para implementar 10 gigawatts de aceleradores concebidos pela OpenAI até 2029. Cryptopolitan noticiou o facto quando a parceria foi inicialmente delineada.

Será que a OpenAI vai passar a utilizar exclusivamente os seus próprios chips?

Na Hot Chips, Ho afirmou que a OpenAI irá implementar o chip em bastidores de 128 unidades, com um pod completo a executar 2.048 ASICs. Uma implementação com 128 chips oferece 1,7 exaflops de computação de 4 bits e 27,5 terabytes de HBM4, sendo que cada pacote oferece 15,4 terabytes por segundo de largura de banda de memória.

A OpenAI afirmou ter utilizado os seus próprios modelos para acelerar o desenvolvimento do Jalapeno, passando da fase de projeto até à finalização em apenas nove meses. Ho acrescentou que uma versão de segunda geração está "em fase avançada de desenvolvimento" e uma terceira está em curso.

No entanto, mesmo com as alegações de desempenho excecional, a OpenAI não está a substituir o seu parque de GPUs. Ho descreveu o Jalapeño como parte de uma estratégia de computação que ainda se apoia em "parceiros muito, muito bons" como a Nvidia e a Cerebras. O chip deverá ser implementado em pequenos volumes até ao final de 2026, com uma produção crescente ao longo de 2027.

De salientar que todos os números vieram da OpenAI; a SemiAnalysis verificou pessoalmente as execuções do InferenceX, mas não executou o conjunto completo de testes nem viu os resultados do AgentX.

As mentes mais brilhantes do mundo das criptomoedas já leem nossa newsletter. Quer participar? Junte-se a elas.

Perguntas frequentes

O que é o chip Jalapeño da OpenAI?

O Jalapeño é o primeiro chip personalizado da OpenAI, um ASIC único para inferência, concebido em parceria com a Broadcom e construído para executar modelos treinados, em vez de os treinar.

Como é que o Jalapeño se compara aos chips da Nvidia?

No benchmark InferenceX, a OpenAI afirmou que o Jalapeño apresentou um desempenho de IA por watt de 1,5 a 1,9 vezes superior e uma latência de 1,7 a 3,6 vezes inferior aos sistemas GB200 e GB300 da Nvidia nos testes GPT-OSS 120B, DeepSeek R1 e Kimi K2.5.

Outras empresas podem comprar ou arrendar Jalapeño?

Não. A OpenAI não vende o chip e não tem um mercado de aluguer para o mesmo; o vice-presidente Richard Ho afirmou que a empresa necessita de toda a capacidade computacional para uso próprio, pelo que o Jalapeño apenas serve o tráfego da própria OpenAI.

Compartilhe este artigo
Hannah Collymore

Hannah Collymore

Hannah é escritora e editora com quase uma década de experiência em redação para blogs e cobertura de eventos no universo das criptomoedas. No Cryptopolitan, Hannah contribui para a página de notícias, reportando e analisando os últimos desenvolvimentos em DeFi, RWA, regulamentação de criptomoedas, IA e tecnologias de ponta. Ela se formou em Administração de Empresas pela Universidade Arcadia.

MAIS… NOTÍCIAS