Anthropic lança Opus 5.5 com preços mais baixos e desempenho alegadamente ao nível de Fable

A Anthropic lançou o Opus 5.5 com preços por token mais baixos, saída mais rápida e resultados alegadamente ao nível de Fable, elevando a fasquia para IA empresarial eficiente.

AI News

A Anthropic lançou o Claude Opus 5.5, um novo modelo principal que, segundo a empresa, iguala ou supera o seu sistema mais capaz Fable 5.1 em muitas tarefas, ao mesmo tempo que custa menos a operar. O lançamento dá aos desenvolvedores acesso a um modelo topo de gama mais rápido e mais barato numa altura em que os compradores de IA estão a ponderar capacidade contra custos de inferência.

O Opus 5.5 está disponível de imediato através dos serviços da Anthropic e das principais plataformas de nuvem. A empresa também afirma ter melhorado o estilo de escrita do modelo, reduzindo jargão e colocando informações importantes mais cedo nas respostas. Essas alterações visam uma queixa recorrente sobre a saída formulaica ou excessivamente elaborada de modelos Claude anteriores.

Preços mais baixos, saída mais rápida

Anthropic lista o Opus 5.5 a 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída, abaixo dos 5 e 25 dólares do Opus 5. A empresa também diz que os custos de leitura de cache caíram 60 por cento. A TechCrunch noticiou o preço de saída como uma redução de 25 para 20 dólares por milhão de tokens e observou que o novo modelo requer menos computação para ser servido.

A Anthropic estima que os custos operacionais totais devem ser cerca de 40 por cento mais baixos do que no Opus 5 quando o uso de tokens é incluído. Essa estimativa mais ampla reflete a alegada capacidade do modelo de usar menos tokens, bem como a saída gerada mais de 30 por cento mais rápido. A distinção é importante para equipas de produção: preços de tabela mais baixos não garantem automaticamente contas mais baixas se um modelo usar substancialmente mais tokens em tarefas difíceis.

Os limites de utilização de cinco horas para subscritores vão aumentar 20 por cento, segundo o relato do The Decoder sobre o anúncio da Anthropic. A Anthropic diz que a combinação de limites mais altos e custos de utilização mais baixos deverá ampliar a capacidade prática em cerca de 25 por cento.

O modelo está disponível na Claude Platform com o ID de modelo claude-opus-5-5, bem como através da Amazon Web Services, Google Cloud e Microsoft Azure. Essa distribuição dá às equipas empresariais mais opções para integrar o modelo em sistemas existentes de nuvem, conformidade e aprovisionamento.

As alegações de desempenho precisam de contexto

A Anthropic descreve o Opus 5.5 como o seu modelo com melhor desempenho até à data e diz que ele iguala o Claude Fable 5.1 na maioria das tarefas. As suas comparações também colocam o novo modelo à frente do GPT-6 Astra da OpenAI em várias avaliações, apesar de um preço de tabela mais baixo. Estas são alegações reportadas pelo fornecedor e não devem ser tratadas como confirmação independente de superioridade geral.

O The Decoder relatou as comparações de programação da Anthropic com mais detalhe. No FrontierCode, a empresa diz que o Opus 5.5 supera o GPT-6 Astra com cerca de 20 por cento do custo por tarefa. No Terminal-Bench 4.0, a Anthropic afirma desempenho comparável a 40 por cento do custo do Astra, enquanto no CursorBench relata uma vantagem de 11 pontos sobre o GPT-5.6 Sol a um terço do custo.

Há algum apoio externo para a posição do modelo nos benchmarks. A Artificial Analysis, uma plataforma independente citada pelo The Decoder, atribuiu ao Opus 5.5 uma pontuação de 58 no seu Intelligence Index em esforço máximo, a pontuação mais alta registada nesse índice no momento da reportagem. Também relatou resultados líderes em seis de dez avaliações, incluindo Humanity’s Last Exam e SciCode.

No entanto, a mesma análise identificou uma troca de eficiência. Em esforço máximo, o Opus 5.5 terá gerado cerca de 119.000 tokens de saída por tarefa, contra 73.000 no Opus 5, 78.000 no Fable 5.1 e 27.000 no GPT-6 Astra. Preços mais baixos por token podem compensar esse uso em algumas cargas de trabalho, mas o modelo não é necessariamente mais barato em cada tarefa individual.

Mudanças de comunicação e segurança

A Anthropic diz que o Opus 5.5 é menos propenso a usar jargão, mais propenso a começar com as informações mais importantes e melhor a seguir instruções de escrita. Os primeiros testadores descritos pelo The Decoder acharam a saída mais clara, mas essas impressões permanecem limitadas e não substituem uma avaliação controlada em fluxos de trabalho reais.

O lançamento também amplia os controlos de segurança aplicados aos modelos de maior capacidade da Anthropic. O Opus 5.5 recebe salvaguardas comparáveis ao Fable 5.1 para cibersegurança, biologia e desenvolvimento de IA de fronteira. A Anthropic diz que pedidos que acionem esses controlos podem ser encaminhados para outro modelo. A maior parte do trabalho de cibersegurança sinalizado terá sido direcionada para o Opus 4.8, enquanto certos pedidos de biologia e desenvolvimento de fronteira vão para o Opus 5.

Organizações verificadas podem candidatar-se a acesso para investigação biológica através do Life Sciences Verification Program da Anthropic. A empresa planeia estender o seu Cyber Verification Program ao Opus 5.5. O modelo também inclui “Preserved Thinking”, que restringe utilizadores da API de editar o contexto anterior para extrair raciocínio, e medidas de watermarking descritas como apoio ao cumprimento da EU AI Act.

A Anthropic diz que o Opus 5.5 foi avaliado antes do lançamento por METR e Frontier Design. A empresa também está a preparar filtragem mais rigorosa para ambientes de reinforcement learning, monitorização mais forte e cenários automatizados de treino de segurança. Estes planos são importantes, mas descrevem trabalho em curso e não evidenciam que todos os riscos de alinhamento ou uso indevido estejam resolvidos.

O que o lançamento significa para os construtores

Para equipas de software, a principal oportunidade não é apenas o acesso a uma pontuação de benchmark mais alta. Um modelo que combine forte desempenho em programação e trabalho de conhecimento com preços publicados mais baixos pode tornar os agentes de IA de longa duração mais práticos, especialmente para revisão de código, depuração, documentação, investigação e análise interna.

O quadro de custos dependerá fortemente dos níveis de esforço, do design dos prompts, da reutilização de contexto e do comprimento da saída. Os números da Artificial Analysis sugerem que o Opus 5.5 em esforço máximo pode consumir muito mais tokens do que sistemas concorrentes. As equipas devem, portanto, testar o custo por fluxo de trabalho concluído em vez de comparar apenas os preços dos tokens.

Para compradores empresariais, a disponibilidade na Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure pode reduzir a fricção de implementação. Mas os compradores ainda terão de validar a latência, as opções de retenção de dados, o comportamento de encaminhamento quando as salvaguardas são ativadas e a fiabilidade do modelo nos seus próprios documentos e ferramentas. As alegações da Anthropic sobre escrita mais clara podem importar em sessões longas, mas devem ser medidas contra modelos existentes em vez de assumidas.

O lançamento da Anthropic também intensifica a concorrência entre modelos premium. A empresa está a posicionar o Opus 5.5 contra o Fable 5.1 e o GPT-6 Astra, ao mesmo tempo que responde a alternativas mais baratas, incluindo modelos chineses que o The Decoder descreveu como oferecendo desempenho inferior a preços muito mais baixos. A próxima fase da concorrência pode ser decidida tanto pelo custo por tarefa bem-sucedida e pelos controlos de implementação como pela liderança em benchmarks que domina manchetes.

O que observar a seguir

O sinal imediato será se avaliações independentes reproduzem os ganhos reportados pela Anthropic em programação, trabalho agentivo e tarefas empresariais. Os custos reais para os clientes serão outro teste importante, especialmente para cargas de trabalho de esforço máximo que geram saídas grandes.

A Anthropic diz que o Sonnet 5.5 e o Haiku 5.5 chegarão nas próximas semanas com melhorias semelhantes em desempenho, eficiência e segurança. Os seus preços e capacidades mostrarão se as mudanças do Opus representam uma reformulação mais ampla da família ou principalmente uma atualização de topo de gama.

Os desenvolvedores também devem acompanhar o lançamento do Cyber Verification Program, alterações no encaminhamento do modelo sob controlos de segurança e mais detalhes sobre as medidas de monitorização e anti-destilação da Anthropic. Essas políticas podem afetar quais fluxos de trabalho de investigação e segurança podem correr diretamente no Opus 5.5.

Perspetiva Creati.ai

O Opus 5.5 é significativo porque a Anthropic está a vender eficiência como parte da capacidade, e não como um compromisso contra ela. Os resultados reportados pela empresa sugerem que os produtos premium de IA estão a avançar para uma métrica mais prática: o custo e a fiabilidade de concluir todo um fluxo de trabalho.

A evidência é promissora, mas continua fortemente moldada pelos próprios benchmarks e escolhas de teste da Anthropic. Para construtores e compradores, a resposta sensata é uma avaliação direcionada: medir conclusão bem-sucedida de tarefas, consumo de tokens, latência, encaminhamento de segurança e requisitos de edição humana em trabalhos representativos antes de tratar a alegada redução de 40 por cento dos custos operacionais como um facto de produção.

Anúncios