OpenAI GPT-5 recebe avaliações mistas no primeiro dia

- A OpenAI lançou o GPT-5 após meses de expectativa, prometendo grandes avanços em raciocínio, codificação e velocidade.
- As primeiras avaliações são mistas, com alguns elogiando suas capacidades e outros apontando erros em matemática, ortografia e raciocínio.
- Os usuários reagiram contra a redução da transparência e a perda de modelos anteriores como o GPT-4o.
O CEO da OpenAI, Sam Altman, havia adiantado o GPT-5 por meses. Ele afirmou que se tratava de um modelo avançado – mais inteligente, mais rápido e capaz de pensar em nível de “doutorado”. A empresa posicionou esse lançamento como um grande passo à frente para o ChatGPT – destinado a levar a melhorias na inteligência de codificação, raciocínio e precisão.
Mas as primeiras reações pintam um quadro mais confuso. Desenvolvedores elogiaram o modelo por compreender prompts complexos e gerar código bem estruturado. O testador inicial Simon Willison descreveu o GPT-5 como “competente” e “ocasionalmente impressionante”, mas não como um salto enorme em relação ao GPT-4. Outros ficaram menos impressionados.
Várias postagens em redes sociais rapidamente se transformaram em reclamações sobre numerosos erros factuais, habilidades matemáticas fracas e — em alguns casos — até mesmo erros básicos de ortografia. Noah Giansiracusa, professor de matemática da Bentley University, classificou o lançamento como 'decepcionante', observando que as atualizações em questão pareciam 'mais marginais do que eu teria esperado'.
Parte da confusão deveu-se à arquitetura do modelo. O GPT-5 incluiria um 'autotransferidor' para os vários tamanhos de modelo, dependendo da sua tarefa. Isso economiza processamento e significa que você não está sempre usando o GPT-5 completo, o que acabou por enganar muitas pessoas. Ao responder incorretamente a uma pergunta no sistema, o agente com o qual estava trabalhando instruiu-o a 'pensar mais forte' sobre quantas letras 'b' existem na palavra blueberry. Após esse feedback, ele acertou a resposta quando questionado.
Usuários reagem — e a OpenAI responde
A frustração poderia transbordar para o Reddit e X até sexta-feira. E, embora alguns usuários odeassem o fato de não saberem quem ou qual modelo gerou o texto, muitos sentiram que o inferno era apenas uma inferência, e que o GPT-5 substituiu antigos favoritos em quem confiavam. Alguns disseram que a qualidade foi afetada, a escrita não é tão boa quanto GPT-4.5, conforme você concordou que deveria ser, e algumas coisas criativas e técnicas pareceram piores.
Este chat levou o CEO da OpenAI a participar de um “Pergunte-me Qualquer Coisa” no Reddit para abordar a controvérsia. Ele disse que um bug no autotroca fez com que o GPT-5 operasse abaixo de seu potencial total desde o primeiro dia. Ele prometeu maior transparência nas futuras transições de modelos: “a partir de hoje, o GPT-5 deve parecer cada vez mais inteligente.” A OpenAI também prometeu realocar modelos anteriores, como o GPT-4o, para aqueles que expressaram preferência, num esforço para acalmar os críticos mais vocais.
A necessidade de agir tão rapidamente destaca o quão elevadas eram as apostas. Hoje, a OpenAI está em uma corrida frenética contra concorrentes como Anthropic, Google DeepMind e até mesmo o xAI de Elon Musk. Com toda essa concorrência, um pequeno erro pode fazer com que seu concorrente tome a frente.
A competição se intensifica na corrida pela IA
Mesmo com tais diferenças, a recepção ao GPT-5 foi morna, mas isso não impediu que ele fosse escalado para o primeiro lugar no LMArena, um ranking liderado por usuários para treinar modelos. Embora não fosse o que consideraríamos hoje como programável, era extremamente rápido e expressivo, suportando consultas grandes e complexas. No entanto, outros benchmarks mostraram uma paisagem de problemas diferente e mais desafiadora. O Grok 4 da xAI de Musk obteve pontuação tão alta no ARC-AGI-2 (um conjunto de testes para raciocínio avançado) que apresentou um desafio significativo à supremacia da OpenAI.
Alguns analistas do setor especulam que levará pelo menos um dia até que os efeitos do GPT-5 sejam totalmente compreendidos, semelhante a avanços anteriores da empresa, como o GPT-3. O GPT-5 e o GPT-4 receberam críticas significativas antes de verem melhorias em atualizações e outros casos de uso. O modelo tem potencial para ter sucesso (ou falhar), dependendo de quão útil será para o fluxo de trabalho diário das pessoas, e existem quase 700 milhões de usuários semanais do ChatGPT em todo o mundo.
Nas palavras do professor da Wharton Ethan Mollick: “O GPT-5 simplesmente faz coisas, às vezes coisas incríveis, às vezes coisas intrigantes, inteiramente por conta própria. É isso que o torna tão fascinante. Ainda é uma abordagem tecnocrática e um pouco assustadora chamar coisas como esta de parte da esfera da saúde pública ‘interessante’
Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.

Nellius Irene
Nellius é graduada em Gestão de Negócios e TI, com cinco anos de experiência no setor de criptomoedas. Também é formada pela Bitcoin Dada. Nellius contribuiu para publicações de mídia de destaque, incluindo BanklessTimes, Cryptobasic e Riseup Media.
















