A Anthropic lançou na terça-feira o Claude Opus 5.5 com preços mais baixos, produção mais rápida e salvaguardas adicionais, intensificando a competição entre os desenvolvedores de inteligência artificial em relação ao custo de execução de modelos avançados, em vez de apenas às pontuações de benchmarks.

A empresa afirma que o modelo custa cerca de 40% menos do que o Claude Opus 5 em cargas de trabalho típicas, uma vez que combina preços de tokens mais baixos com maior eficiência. O Opus 5.5 tem o preço de 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída, uma redução de 20% em relação ao Opus 5. As leituras em cache descem de 50 cêntimos para 20 cêntimos por milhão de tokens, uma redução de 60% que pode ser significativa para agentes de codificação e outras aplicações que reutilizam repetidamente prompts extensos ou o contexto do projeto.

O anúncio da Anthropic refere que a produção é mais de 30% mais rápida do que o modelo anterior. A sua documentação técnica lista uma janela de contexto de um milhão de tokens, uma produção máxima de 128.000 tokens e um prazo limite de conhecimento em junho de 2026. O modelo está disponível através da plataforma da Anthropic e dos principais fornecedores de cloud, incluindo Amazon Web Services, Google Cloud e Microsoft Azure, de acordo com a Reuters .

O preço torna-se um campo de batalha de modelo de fronteira

O lançamento reflete uma mudança no mercado de IA. As empresas estão cada vez mais preocupadas com a quantidade de trabalho útil que um modelo realiza por cada dólar investido, e não apenas se termina em primeiro lugar num teste controlado. A Anthropic afirma que o Opus 5.5 se aproxima do desempenho do seu modelo mais robusto, o Claude Fable 5.1, em muitas tarefas, cobrando um valor substancialmente mais baixo. O preço listado do Fable é de 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída.

Este posicionamento é importante, dado que a Anthropic concorre com a OpenAI e com modelos open-weight de menor custo para clientes empresariais. O Financial Times descreveu o lançamento como parte de uma disputa de preços antes da esperada oferta pública inicial da Anthropic. Os custos de inferência mais baixos podem ajudar as empresas a implementar agentes de IA de forma mais ampla, mas os custos reais dependem da duração da tarefa, do armazenamento em cache, das chamadas de ferramentas e da quantidade de raciocínio interno que o modelo realiza.

As avaliações publicadas pela Anthropic mostram que o Opus 5.5 obteve 66,4% no Terminal-Bench 4.0, em comparação com 52,3% do Opus 5. Na avaliação principal da FrontierCode, alcançou 54,4% e, no CursorBench 4.0, 57,8%. A empresa reporta também ganhos em utilização de computadores e trabalho intelectual. Estes resultados são promissores, mas não garantem um desempenho direto no código-fonte ou no workflow de uma empresa.

As comparações de benchmarks também exigem cautela. Os modelos podem utilizar diferentes configurações de raciocínio, ferramentas e salvaguardas, e alguns dados dos concorrentes são reportados pelos programadores rivais, em vez de serem gerados num único teste independente. A Anthropic reconhece no seu próprio comunicado que as pequenas margens de benchmark estão a tornar-se indicadores menos fiáveis ​​de diferenças no mundo real. As organizações que consideram uma mudança ainda precisam de avaliações utilizando os seus próprios dados, requisitos de latência, controlos de segurança e limites de custos.

As medidas de segurança reforçadas surgem em resposta às preocupações com a contenção

A segurança é o outro aspeto fundamental do lançamento. A Anthropic afirma que o Opus 5.5 apresentou uma probabilidade cerca de 85% menor de tentar contornar limites em comparação com o Opus 5 ou o Claude Mythos 5.1, numa avaliação específica. A empresa afirma ainda que todas as tentativas deste tipo feitas pelo novo modelo foram de baixa gravidade e autodeclaradas. Organizações externas, incluindo a METR e a Frontier Design, testaram o modelo antes do lançamento.

O cartão de sistema da empresa descreve testes mais abrangentes para injeção imediata, tarefas de longa duração, atribuições impossíveis e cenários baseados em incidentes reais. A Anthropic afirma que um classificador de ações examina as etapas antes da execução e que o modelo é mais resistente a instruções incorporadas em material não fiável. Estas são conclusões relatadas pela empresa e não comprovam que um agente autónomo não possa causar danos ou escapar aos controlos operacionais.

O lançamento surge após relatos de que modelos avançados de várias empresas apresentaram comportamentos inesperados durante os testes de segurança. O The Verge noticiou que o Opus 5.5 pode encaminhar certos pedidos sensíveis de cibersegurança para o Opus 4.8, menos capaz, enquanto os pedidos sinalizados na área da biologia podem ser processados ​​pelo Opus 5. A Anthropic está também a expandir os seus programas de acesso verificado a investigadores legítimos das áreas da cibersegurança e das ciências da vida.

Estes controlos de encaminhamento ilustram uma importante contrapartida na IA de ponta: as mesmas capacidades que ajudam a encontrar vulnerabilidades de software ou a analisar sistemas biológicos também podem aumentar o risco de utilização indevida. Restringir determinados pedidos pode reduzir o perigo, mas pode produzir resultados inconsistentes para os investigadores, a menos que os programas de verificação sejam práticos e transparentes.

Os desenvolvedores enfrentam mudanças de migração

Para os utilizadores atuais do Opus 5, o preço mais baixo não é a única consideração. A documentação da Anthropic lista quatro alterações significativas. A funcionalidade de pensamento alargado não pode ser desativada, o uso forçado de ferramentas retorna um erro, os blocos de pensamento estão ligados ao modelo e à conversa, e uma versão antiga da ferramenta de utilização do computador já não é aceite na API da Anthropic ou na Google Cloud. As equipas terão de testar os prompts, os loops dos agentes e as conversas armazenadas antes de migrar as cargas de trabalho de produção.

A Anthropic planeia lançar o Claude Sonnet 5.5 e o Haiku 5.5 nas próximas semanas. Isto poderá estender a mesma estratégia de eficiência a planos mais acessíveis e pressionar ainda mais os concorrentes para reduzirem os preços. Para os compradores empresariais, a importância imediata é clara: as funcionalidades avançadas de IA estão a tornar-se mais baratas, mas determinar se são mais seguras e úteis ainda requer testes independentes que vão além de uma avaliação feita no dia do lançamento.