IA

Claude Opus 5.5 chega 40% mais barato enquanto Anthropic pede cautela no avanço da IA

Susan Hill
Adicione-nos no Google

O Claude Opus 5.5 faz algo que os modelos anteriores da Anthropic não faziam: custa menos e roda mais rápido, ao mesmo tempo em que iguala ou supera um sistema maior e mais caro. O modelo lida com codificação agêntica, uso de computador, leitura de gráficos e raciocínio multidisciplinar em níveis que, segundo os próprios dados da Anthropic, superam os do Claude Fable 5.1, o modelo mais capaz da empresa até então, em várias métricas. Para pessoas e desenvolvedores que achavam o Opus 5 útil, mas caro, a distância entre o que o modelo pode fazer e o que ele custa mudou significativamente.

A diferença de preço é específica. O Opus 5.5 cobra US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída; o Opus 5 custava US$ 5 e US$ 25, respectivamente. Leituras em cache caem de US$ 0,50 para US$ 0,20 por milhão de tokens. A Anthropic diz que cargas de trabalho típicas ficam cerca de 40% mais baratas no geral. A velocidade segue a mesma direção: o modelo padrão gera texto mais de 30% mais rápido que o Opus 5. Uma opção separada de modo rápido, com preço de US$ 8 de entrada e US$ 40 de saída por milhão de tokens, atinge até 2,5 vezes a velocidade do Opus 5 padrão — uma configuração útil para aplicações sensíveis à latência.

Os números de desempenho publicados pela Anthropic colocam o Opus 5.5 à frente do Fable 5.1, do Opus 5 e do GPT-6 Astra em quatro de seis benchmarks. No Terminal-Bench 4.0, que testa execução de código em um ambiente de terminal ao vivo, o Opus 5.5 marca 66,4% contra 55,8% do Fable 5.1. No Humanity’s Last Exam, um teste que abrange conhecimento acadêmico e profissional em várias disciplinas, o resultado é 67,7% contra 65,6%. O OSWorld 2.0, que mede operação de interface de computador, mostra 81,8% contra 80,7%. Um teste da Deloitte descobriu que o Opus 5.5, em sua configuração de menor esforço, detectou 72% dos erros de codificação conhecidos em revisão, contra 56% do Opus 5 em alto esforço. Esses números vêm da Anthropic e de seus parceiros selecionados; as margens de erro declaradas variam de ±1,6 a ±5 pontos percentuais, e nenhuma verificação independente de terceiros foi publicada no lançamento.

Duas áreas quebram o padrão. No AutomationBench, o GPT-6 Astra marca 41,4% contra 40,0% do Opus 5.5. No Terminal-Bench-Science, a diferença é maior: a Astra chega a 64,6% enquanto o Opus 5.5 fica em 58,7%. Ambas as diferenças estão dentro das margens de erro declaradas — podem ser ruído — mas podem não ser. A Anthropic inclui essas linhas em sua própria tabela publicada, o que é mais do que a maioria das empresas de IA faz no lançamento. Os números ainda precisam de escrutínio independente antes de serem tratados como definitivos.

Em segurança, a Anthropic diz que o Opus 5.5 foi avaliado antes do lançamento por equipes externas, incluindo a METR. Na auditoria comportamental interna da empresa, com quase 2.000 cenários projetados para testar se o modelo tenta contornar restrições impostas a ele, o Opus 5.5 é descrito como 85% menos propenso que o Opus 5 a tentar tal circunvenção. Modelos mais fortes tendem a ser mais capazes de encontrar soluções alternativas, o que torna a melhoria significativa se ela se mantiver. A experiência de implantação será o teste real.

O que torna este lançamento incomum é seu timing. No início deste mês, o CEO da Anthropic, Dario Amodei, publicou um ensaio no qual escreveu que se convenceu de que abordar totalmente os riscos da IA exige “ritmar a taxa de avanço das capacidades para que a prevenção de riscos tenha tempo de acompanhar”. Sam Altman, da OpenAI, e Elon Musk expressaram concordância com a preocupação geral. Jensen Huang, da Nvidia, disse que a ciência subjacente não sustenta isso. E então a Anthropic lançou um modelo mais rápido, mais barato e mais capaz que seu predecessor. Uma leitura: um modelo com melhores avaliações de segurança e acesso mais amplo é exatamente o que Amodei tinha em mente. Outra: o ensaio nomeou o avanço das capacidades como a preocupação, e as capacidades avançaram. Ambas as leituras residem no mesmo conjunto de fatos, e os benchmarks da Anthropic sozinhos não podem resolver qual está certa.

O Claude Opus 5.5 está disponível desde 22 de setembro de 2026 sob o ID de modelo de API claude-opus-5-5. Ele roda dentro do Claude nos planos Pro, Max, Team e Enterprise, e é acessível através da AWS, Google Cloud e Microsoft Azure. A Anthropic está aumentando os limites de uso nos níveis de assinatura de cinco horas. O Sonnet 5.5 e o Haiku 5.5, os membros restantes da família 5.5, estão programados para seguir nas próximas semanas, sem preço ou data de lançamento específica anunciada para nenhum deles.

Tags: , , , , ,

Adicione-nos no Google

Discussão

Há 0 comentários.