A Anthropic lança o Claude Sonnet 5.5, enquanto a IA passa a ser baseada no custo por tarefa

- A Anthropic lançou na segunda-feira o Claude Sonnet 5.5, um modelo com o mesmo preço do seu antecessor, mas que, segundo a empresa, é mais de 30% mais rápido e custa até menos 30% por tarefa, dirigido às empresas que representam a maior parte das suas receitas.
- O lançamento do modelo demonstra que a concorrência na área da IA de ponta deixou de lado os índices de referência e passou a priorizar o custo-benefício e o custo por tarefa concluída.
- A Epoch AI registou uma queda de cerca de 47% nos custos de IA por trimestre, mas a Gartner alerta que os gastos totais com inferência ainda podem aumentar mais de cinco vezes até 2028, à medida que os fluxos de trabalho se tornam mais complexos.
A Anthropic lançou o Claude Sonnet 5.5 a 28 de setembro, o segundo da série Claude 5.5, enquanto a empresa se prepara para um IPO. Isto marca uma mudança importante nos critérios utilizados para avaliar as tecnologias de IA: embora o desempenho bruto nos benchmarks continue a ser uma consideração fundamental, as empresas estão agora também preocupadas com o custo para alcançar resultados com um modelo específico.
A Anthropic afirma que o Sonnet 5.5 opera mais de 30% mais rápido em comparação com o Sonnet 5, e que a sua aplicação pode custar até 30% menos para a maioria das tarefas, mesmo que os preços dos tokens permaneçam inalterados. De acordo com a página de lançamento da Anthropic, esta redução de custos é conseguida através da diminuição da utilização de tokens para realizar a mesma tarefa.
Mesmo preço, menos fichas
O Sonnet 5.5 tem um preço de 2 dólares por milhão de tokens de entrada, 10 dólares por tokens de saída utilizados e 0,20 dólares por tokens de leitura de cache utilizados. O Opus 5.5, especializado em raciocínio complexo e operações de julgamento, tem preços de 4 e 20 dólares para tokens de entrada e saída, respetivamente. O Sonnet está orientado para tarefas simples como codificação, geração de documentos e folhas de cálculo.
Isto coloca a eficiência no centro das discussões. Para muitas tarefas, as empresas não têm de optar pelo modelo com melhor desempenho. Se um modelo de baixo custo conseguir executar a tarefa desejada de forma consistente, isso pode ser mais significativo do que obter uma pontuação ligeiramente mais elevada num benchmark. Este aspeto é especialmente importante para a Anthropic, uma vez que, segundo a Reuters , cerca de 80% da receita da empresa provém de clientes empresariais.
Os indicadores de desempenho deixam de ser a história completa
Segundo a Anthropic, o Sonnet 5.5 obteve 70,6% no Terminal-Bench 4.0, em comparação com os 10,3% do Sonnet 5. Mas a tabela de classificação da Artificial Analysis mostra porque é que as pontuações de benchmark representam apenas parte da história.
O Sonnet 5.5, com o máximo esforço, atinge uma pontuação de 56 na escala de inteligência, com um custo estimado de 7,60 dólares por tarefa individual. O GPT-6 Sol consegue 48 pontos a 1,06 dólares por tarefa, enquanto o MiMo-V2.6-Pro da Xiaomi atinge uma pontuação de 46 por um custo irrisório de apenas 0,13 dólares. Estas diferenças de custos motivam as empresas a optar por múltiplas abordagens: é possível atribuir tarefas mais complexas a sistemas de ponta, enquanto as tarefas rotineiras podem ser executadas por sistemas mais baratos.

O preço do pensamento continua a cair
Esta mudança insere-se numa tendência muito maior observada ao longo do tempo. De acordo com o relatório da Epoch AI de 22 de setembro, os custos para um nível específico de desempenho da IA diminuíram aproximadamente 47% a cada trimestre a partir de 2023, uma redução anual de cerca de 13 vezes.
Um Cryptopolitan relatório publicado a 29 de setembro refere que os compradores empresariais estão cada vez mais a optar pelo modelo mais acessível que execute as tarefas necessárias, enquanto os preços baixos também permitem às empresas justificar a utilização de múltiplos modelos.
Fichas mais baratas, notas maiores
No entanto, custos mais baixos não garantem menores despesas com IA. O relatório da Gartner de 17 de agosto, intitulado "Gartner prevê que os custos de inferência de IA por fluxo de trabalho agente aumentarão mais de cinco vezes até 2028", aborda o "paradoxo da inferência". A queda do preço dos tokens estimula fluxos de trabalho mais complexos, o que resulta num aumento da utilização total de tokens.
“Os líderes de produto não podem confiar numa economia de tokens mais eficiente para racionalizar os custos de IA.”
— Will Sommer, Analista Diretor Sénior da Gartner, no relatório da Gartner de 17 de agosto de 2026.
Quem fica realmente com a IA mais barata?
De acordo com o Relatório Global de Difusão da IA publicado pela Microsoft, os modelos de baixo custo e com código aberto têm o potencial de aumentar a acessibilidade, particularmente no Sul Global. Embora seja verdade que os custos mais baixos dos modelos melhoram a acessibilidade, a infraestrutura, a conectividade e as competências são fatores decisivos para a utilização de modelos de IA mais baratos.
Para os compradores empresariais, o Sonnet 5.5 mostra para onde caminha o mercado: o melhor modelo não é necessariamente o mais potente, mas sim aquele que consegue realizar bem o trabalho a um custo razoável. O Haiku 5.5, previsto para as próximas semanas, poderá impulsionar ainda mais esta mudança, tornando o trabalho de IA em grande volume mais barato e dificultando as empresas de justificar o pagamento de preços mais elevados por tarefas rotineiras.
Não se limite a ler notícias sobre criptomoedas. Compreenda-as. Assine nossa newsletter. É grátis.
Perguntas frequentes
Qual o preço do livro Claude Sonnet 5.5?
A Anthropic define o preço do Sonnet 5.5 em 2 dólares por milhão de tokens de entrada, 10 dólares por milhão de tokens de saída e 0,20 dólares por milhão de tokens para leituras de cache, sem alterações em relação ao Sonnet 5, embora a empresa afirme que necessita de menos tokens e custa até 30% menos por tarefa.
Em que difere o Soneto 5.5 da Opus 5.5 de Claude?
O Opus 5.5, lançado na semana anterior a 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída, foi desenvolvido para trabalhos complexos que exigem um julgamento cuidadoso, enquanto o Sonnet 5.5, mais rápido e barato, está orientado para tarefas quotidianas, como programação, correção de bugs e criação de documentos e folhas de cálculo.
Modelos de IA mais baratos significam que as empresas gastam menos no geral?
Não necessariamente; a Gartner prevê que os custos de inferência por fluxo de trabalho agentivo aumentem mais de cinco vezes até 2028, porque os tokens mais acessíveis tendem a ser consumidos em volumes muito maiores à medida que os fluxos de trabalho se tornam mais complexos.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. CryptopolitanO não se responsabiliza por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamostrona realização de pesquisas independentesdent /ou a consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Ibiam Wayas
Ibiam Wayas cobre notícias sobre criptomoedas desde 2019. Ele estudou Ciência da Computação na Universidade Nacional Aberta da Nigéria. Seus trabalhos foram publicados em diversas plataformas de notícias sobre criptomoedas, incluindo Coinfomania, Crypto News Australia e AltcoinBuzz. Com base em sua formação em Ciência da Computação, ele agora se concentra em notícias sobre criptomoedas, robótica e longevidade.
















