Saiu o Opus 5.5. Mais barato, escreve melhor e ainda veio com reset.
O primeiro modelo da família 5.5 chega no nível do Fable 5.1 na maior parte do trabalho, custa 40% menos que o Opus 5 e aumenta o limite no Pro, Max e Team. E o reset que faltou no meu post chegou, pra você guardar e usar quando quiser.

Hoje, 22 de setembro, a Anthropic lançou o Claude Opus 5.5. Eu postei no calor do lançamento e fechei o post reclamando que só faltava uma coisa: o reset.
Algumas horas depois ele veio. E veio melhor do que eu tinha pedido, porque você não é obrigado a usar agora. Dá pra guardar.
Então vamos por partes, que tem bastante coisa boa nesse lançamento e muita gente vai ler só o título. Tudo que está aqui embaixo saiu da página oficial do Opus 5.5, traduzido e em palavras simples.
O que é o Opus 5.5
A primeira frase da página já resume o lançamento:

Olha o tamanho disso. O Fable 5.1 saiu faz três semanas como o modelo mais forte da casa, aquele que a própria Anthropic dizia pra usar quando o Opus 5 não desse conta. Agora o Opus, que é o modelo do dia a dia, chega nesse nível na maior parte do trabalho gastando menos.
Na API o nome é claude-opus-5-5. Está disponível em todas as plataformas deles, incluindo AWS, Google Cloud e Microsoft Azure.
Onde entram os 40%
Aqui vale ler com calma, porque o 40% não é só o preço da tabela.

A Anthropic escreve que o Opus 5.5 precisa de menos poder de computação pra rodar do que o Opus 5, e que o preço reflete isso. A tabela, em dólar, por milhão de tokens:
- Entrada: US$ 4 (o Opus 5 era US$ 5)
- Saída: US$ 20 (era US$ 25)
- Releitura do contexto guardado: US$ 0,20 (era US$ 0,50)
Por token, ficou 20% mais barato. A releitura do contexto guardado, que é quando o modelo lê de novo o que já tinha processado, caiu 60%, e segundo eles é a maior parte do custo de quem trabalha com agente e com código.
O resto da conta vem de outro lugar: o Opus 5.5 usa menos token pra fazer a mesma tarefa. Somando as duas coisas, no esforço padrão, a Anthropic diz que uma tarefa típica sai 40% mais barata do que no Opus 5.
E ficou mais rápido também. Ele gera resposta mais de 30% mais rápido que o Opus 5. Se você precisa de velocidade de verdade, tem o fast mode no Claude Code e na Plataforma Claude, até 2,5 vezes mais rápido, por US$ 8 de entrada e US$ 40 de saída.
O exemplo que eles deram mostra bem a diferença. Um testador usou o Opus 5.5 pra auditar e corrigir um sistema de 200 mil linhas de código em menos de três horas. O Opus 5 levou mais de 20 horas no mesmo trabalho e gastou 2,5 vezes mais tokens.
A Optiver, uma empresa de trading, contou na página que o Opus 5.5 entregou a mesma qualidade do Opus 5 em mais ou menos metade dos passos, do tempo e dos tokens, e que isso cortou de 40% a 50% do custo daquele trabalho.
E tem a comparação com a OpenAI, que eles fizeram questão de colocar: no esforço padrão, o Opus 5.5 passa o GPT-6 Astra num teste de programação (FrontierCode) custando cerca de 20% do que o Astra custa por tarefa. No Terminal-Bench 4.0 ele empata com o Astra por uns 40% do custo.
Falta o resto desta edição
Inscrição única, uma vez só. Libera esta e todas as outras edições, e você recebe as próximas no e-mail assim que entrarem no ar.