A Anthropic colocou no ar nesta terça-feira (22) o Claude Opus 5.5, o primeiro modelo da nova família Claude 5.5. A promessa da empresa cabe numa frase: entregar, na maior parte do trabalho, o mesmo nível do Claude Fable 5.1 — o modelo mais caro da casa — gastando em média 40% menos do que o Opus 5 lançado alguns meses atrás.
A conta dos 40% junta dois efeitos. O primeiro é o preço de tabela: US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída, 20% abaixo do antecessor. O segundo é que o modelo resolve as tarefas usando menos tokens. Para quem roda agentes e programação, o número que mais pesa é o do cache, que caiu para US$ 0,20 por milhão (60% a menos). A geração de texto também ficou mais de 30% mais rápida, e um modo rápido, no Claude Code e na Claude Platform, acelera até 2,5 vezes cobrando o dobro (US$ 8 e US$ 40).

Nos testes divulgados, o Opus 5.5 aparece à frente em programação com agentes, uso de computador e trabalho de escritório. No FrontierCode, que mede se as alterações de código seriam aceitas num projeto real, marcou 54,6% no esforço padrão, contra 53,3% do GPT-6 Astra, da OpenAI, custando cerca de um quinto por tarefa. No CursorBench fez 52,5%, acima do Fable 5.1 (51,8%) e do Opus 5 (46,6%). Mas a vitória não é total: em dois testes, o AutomationBench e o Terminal-Bench-Science, o rival da OpenAI ainda leva a melhor. A própria Anthropic admite que, nesse patamar, a diferença entre os modelos nos benchmarks diz cada vez menos sobre o uso no dia a dia.
Os exemplos práticos ajudam a dimensionar. Um testador levou menos de um dia numa migração de 680 mil linhas de código, algo que tomaria semanas de uma equipe; outro auditou e corrigiu uma base de 200 mil linhas em menos de três horas — o Opus 5 tinha levado mais de 20 e gastado 2,5 vezes mais tokens. A empresa também diz ter trabalhado na escrita: as respostas colocam o principal no começo, evitam jargão e seguem as regras de estilo definidas pelo usuário, uma resposta às queixas sobre o Opus 5. O texto gerado sai com marca d’água invisível, como já acontecia com o Fable 5.1.

Na parte de segurança, a Anthropic afirma que o Opus 5.5 teve a melhor nota já registrada na sua bateria automática de testes de comportamento e resiste melhor a injeção de instruções maliciosas. Como o desempenho em biologia e cibersegurança ficou parecido com o do Mythos 5.1, o modelo vem com as mesmas travas do Fable 5.1, e pesquisas nessas áreas passam por programas de verificação de organizações.
Para o usuário brasileiro, a novidade mais concreta é que o Opus 5.5 não exige créditos extras: ele já está nos planos pagos, que ganharam limite maior por janela de cinco horas e um “reset” de limite que pode ser guardado para usar quando quiser. O modelo também está disponível pela AWS, Google Cloud e Microsoft Azure. O Sonnet 5.5 e o Haiku 5.5 devem vir nas próximas semanas.
