Pular para o conteúdo
← Todas as notícias

Anthropic detalha como o Claude Opus 5.5 reduz custos em sessões longas de código

A empresa estima que o Opus 5.5 custa cerca de 40% menos que o Opus 5 em usos típicos cobrados por token e corta em 60% o preço da leitura de tokens em cache.

A Anthropic detalha que o Claude Opus 5.5 foi precificado e treinado para gastar menos em sessões longas de programação. A empresa estima que o modelo custa cerca de 40% menos para executar do que o Opus 5 em usos típicos cobrados por token.

Anthropic detalha como o Claude Opus 5.5 reduz custos em sessões longas de código

A principal mudança está no preço: os tokens de entrada e saída ficaram 20% mais baratos, e a leitura de tokens em cache caiu 60%. A empresa diz que esse segundo corte pesa mais porque a maior parte do custo de trabalhos com agentes e código vem justamente de leituras repetidas do que já foi carregado.

A Anthropic também afirma ter reduzido em mais de 50% a entrada que não aproveita o cache, com ajustes para evitar que o cache seja quebrado por ações como renovar um login, inserir instruções no meio da conversa ou carregar ferramentas sob demanda. Em modelos como o Opus 5.5 e o Fable 5.1, também é possível mudar o nível de esforço durante a sessão sem reiniciar o cache.

Segundo a empresa, o contexto por requisição aumentou cerca de 2,6 vezes nos últimos seis meses, o que amplia o impacto dessas mudanças. A Anthropic ainda diz que, na data da publicação, um token em cache no Opus 5.5 custa um quinto do preço cobrado por modelos concorrentes, mas essa comparação é a afirmação da empresa, não um teste independente.

← Todas as notícias