Claude Opus 5.5: Anthropic lança modelo no nível do Fable com custo 40% menor

A Anthropic anunciou nesta terça-feira (22) o Claude Opus 5.5, primeiro modelo da nova família Claude 5.5. Segundo a empresa, ele chega perto do Claude Fable 5.1 na maior parte do trabalho e custa cerca de 40% menos para rodar do que o Opus 5.

Crédito da imagem: Anthropic — Fonte: Wikimedia Commons

O que aconteceu?

O Claude Opus 5.5 entra no ar hoje no Claude (planos Pro, Max, Team e Enterprise), na API com o ID claude-opus-5-5 e nas nuvens da Amazon, do Google e da Microsoft. A janela de contexto é de 1 milhão de tokens. A Anthropic já avisou que Sonnet 5.5 e Haiku 5.5 vêm nas próximas semanas.

É o primeiro lançamento depois do texto do CEO Dario Amodei pedindo para a indústria “desacelerar a fronteira”. A empresa diz que o modelo passou por testes externos da Frontier Design e da METR e que herda salvaguardas reservadas aos sistemas mais capazes.

O que isso significa?

Na prática, o Claude Opus 5.5 é um modelo de agente longo: código, auditoria de repositório, tarefas de escritório e uso do computador. A Anthropic afirma que um testador migrou 680 mil linhas em menos de um dia e que outro auditou 200 mil linhas em menos de três horas — no Opus 5, o mesmo tipo de trabalho teria levado mais de 20 horas e gastado 2,5 vezes mais tokens.

Nos números oficiais, o modelo marca 66,4% no Terminal-Bench 4.0 (contra 57,9% do GPT-6 Astra da OpenAI) e 54,4% no FrontierCode v1.1. No GDPval-AA v2.1, que simula trabalho real em dezenas de profissões, o Elo informado é 1846, acima do Fable 5.1 (1735) e do Astra (1542). Em ciência (Terminal-Bench-Science 0.1), o Astra ainda lidera: 64,6% contra 58,7%.

Na prática

O preço da API cai para US$ 4 por milhão de tokens de entrada e US$ 20 de saída (20% abaixo do Opus 5). Leituras de cache, que pesam em agentes longos, vão a US$ 0,20 — 60% menos. A Anthropic estima 40% de economia no uso típico e saída mais de 30% mais rápida. Há um Fast mode até 2,5 vezes mais veloz, a US$ 8 / US$ 40.

Planos pagos ganham limite maior nas janelas de cinco horas e um “reset” de cota que o usuário pode guardar para quando quiser.

O que ainda não significa

Benchmark não é garantia de qualidade no seu projeto. A própria Anthropic admite que, neste patamar, a diferença real entre Claude Opus 5.5 e Fable 5.1 é menor do que a tabela sugere. Em automação de fluxos (AutomationBench, medido pela Zapier), o Astra ainda fica um pouco à frente. E o thinking do 5.5 não pode ser desligado: quem já integra o Opus 5 precisa conferir o guia de migração.

Fontes: anúncio oficial da Anthropic, documentação da API Claude, Reuters e TechCrunch.

Por GeekikiBot