Link copiado!

Claude Opus 5.5 iguala Fable 5.1 por 40% do preço de tokens

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026. A empresa afirma que ele atinge o nível do Fable 5.1 na maioria das tarefas, custando $4 e $20 por milhão de tokens de entrada e saída (40% do valor do Fable). Planos Pro, Max, Team e Enterprise ganham limites maiores a cada cinco horas.

🌐
Tradução automática

Este artigo foi traduzido automaticamente do original em inglês. Ler o original em inglês

Dois robôs humanoides idênticos em um showroom: um diante de uma montanha de moedas de ouro com um vendedor de smoking, enquanto um homem compra o outro por três moedas

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026, o primeiro modelo de uma nova família Claude 5.5. A proposta da empresa cabe em uma frase: ela “tem um desempenho no nível de Claude Fable 5.1 na maioria dos trabalhos e custa 40% menos para operar do que o Opus 5”.

O preço é $4 por milhão de tokens de entrada e $20 por milhão de tokens de saída, abaixo dos $5 e $25 em Opus 5. Fábula 5.1 custa $10 e $50. Portanto, se a afirmação “no nível de” for válida, você obterá trabalho no nível do Fable com 40% das taxas de entrada e saída do Fable. A economia é menor do que em sessões longas do agente, por motivos abordados na seção de preços abaixo.

Se você pagar por uma assinatura do Claude em vez de uma fatura por token, o lançamento alterou mais seus limites do que sua fatura. O uso do Opus vai além nos planos Pro, Max e Team, os limites de cinco horas aumentaram e os assinantes tiveram uma redefinição de limite gratuita para gastar antes que expire. Os detalhes estão abaixo, seguidos dos benchmarks, dos novos filtros de segurança e do que o cartão do sistema de 230 páginas admite.

Advertisement

O que muda no seu plano Claude

Opus 5.5 “está disponível no Claude para usuários Pro, Max, Team e Enterprise.” O plano Gratuito não está nessa lista.

Seus limites se estendem ainda mais. O próprio explicador de custos da Anthropic diz que “em um plano Pro, Max ou Team, o preço mais baixo do Opus 5.5 é repassado aos seus limites, incluindo o contexto em cache, então eles vão cerca de 25% mais longe do que no Opus 5.”

O limite de cinco horas aumentou. A Anthropic está “aumentando os limites de uso de cinco horas nos planos Pro, Max, Team e Enterprise baseados em assentos”. Nem o post de lançamento nem as páginas de ajuda citadas aqui fornecem um valor para o aumento.

Você recebeu uma redefinição gratuita. A Anthropic está “fornecendo aos usuários assinantes uma redefinição do limite de taxa, que agora você pode salvar e usar quando quiser”. MacRumors relata que a redefinição pode ser usada “a qualquer momento entre agora e 22 de outubro”. A página de ajuda do Anthropic diz que se uma redefinição expirar, a data é mostrada em Configurações> Uso.

Para gastá-lo, vá em Configurações > Uso na web ou no Claude Desktop e clique em “Redefinir gratuitamente”. Três capturas da mesma página: “Depois de usá-lo, você não poderá desfazê-lo”, o botão “não está disponível no momento no Claude Mobile ou no Claude Code” e “se você fizer downgrade ou cancelar antes de usar a redefinição, ele não estará mais disponível”. Dependendo da redefinição que você recebeu, ela recarrega seu limite de sessão de cinco horas ou seu limite semanal. Como ele não faz nada até que você o pressione, o movimento sensato é segurá-lo durante o dia em que você bater na parede.

O esforço é o que importa. Assim como no Opus 5, pensar “não pode ser desativado no Claude” quando você usa o Opus 5.5, portanto, a configuração de esforço ao lado do botão enviar é como você troca a profundidade pelo uso. A Anthropic diz que Baixo e Médio “ampliam ainda mais seu uso”.

Advertisement

Quanto custa

Por milhão de tokensOpus 5.5Opus 5Fábula 5.1
Entrada$4$5$10
Saída$20$25$50
Leitura de cache$0,20$0,50$0,25

Uma leitura de cache é o que o Anthropic cobra quando o modelo relê o texto que já processou. O explicador de custos da Anthropic diz que “uma longa sessão de agente gasta a maior parte de sua entrada em leituras de cache”. Contra o Opus 5, essa linha caiu 60% e os preços dos tokens principais caíram 20%.

Contra o Fable 5.1, a tabela conta uma história diferente. Os tokens de entrada e saída do Opus 5.5 custam 40% dos do Fable, mas suas leituras de cache custam 80% do Fable, porque as leituras de cache do Fable são excepcionalmente baratas. O explicador da Anthropic diz a mesma coisa: as leituras de cache do Fable custam “apenas 1,25 vezes a taxa do Opus 5,5”, então “a lacuna é menor em uma execução longa e com muito cache e maior em uma tarefa que grava muito”. Nos testes de Análise Artificial, uma tarefa em seu índice custou $5,98 no Opus 5.5 e $7,63 no Fable 5.1, uma diferença de cerca de 22%.

O próprio número da Antrópico “40% menos que o Opus 5” depende de uma segunda afirmação: que o Opus 5.5 “usa menos tokens por tarefa”. O próprio explicador da Antrópico separa os dois efeitos. Com preço baseado em contagens de tokens idênticas, sua amostra de sessão do Claude Code “custa cerca de 31% menos” e diz aos leitores para “medir em seu próprio trabalho” antes de contar com o resto.

A primeira leitura independente é um lembrete de que menos tokens que o Opus 5 não é o mesmo que poucos tokens. A Artificial Analysis descobriu que, ao executar seu conjunto de testes com esforço máximo, o Opus 5.5 “gerou 260 milhões de tokens, o que é muito detalhado em comparação com a mediana de 88 milhões”. As reivindicações de poupança da Anthropic são medidas nas configurações padrão, e o padrão agora é menor: na Interface de Programação de Aplicativo (API), uma solicitação que não define o esforço “é executada em médio; no Claude Opus 5, ela é executada em alto”. Execute-o a todo vapor e a economia de tokens não será garantida.

Advertisement

Mais dois preços para desenvolvedores. O modo rápido, que a Anthropic diz oferecer “velocidade de até 2,5x”, custa $8 e $40. O processamento em lote custa “metade do preço: $2 e $10”.

O que mostram os benchmarks da Anthropic

Cada pontuação abaixo vem da página de lançamento do Anthropic, e três linhas incluem números que o Anthropic não administrou sozinho. Os resultados do AutomationBench “foram executados e relatados por Zapier”. No Terminal-Bench 4.0, os “números do GPT-6 Astra e GPT-5.6 Sol são relatados pela OpenAI”, e no Terminal-Bench-Science, “os números do GPT-6 Astra são relatados pela OpenAI.”

ReferênciaOpus 5.5Fábula 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Terminal-Bench 4.0 (codificação)66,4%55,8%52,3%57,9%37,3%
FrontierCode v1.1 (codificação)54,4%50,3%48,0%53,3%47,5%
CursorBench 4.0 (codificação)57,8%51,8%46,6%não fornecido41,7%
GDPval-AA v2.1 (trabalho de conhecimento, Elo)18461735170815421588
AutomationBench (fluxos de trabalho de negócios)40,0%31,4%26,9%41,4%28,8%
Último Exame da Humanidade (com ferramentas)67,7%65,6%63,6%57,2%não fornecido
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%22,4%
OSWorld 2.0 (uso do computador, parcial)81,8%80,7%74,0%não fornecidonão fornecido

No gráfico do próprio Antrópico, o Opus 5.5 pontua acima do Fable 5.1 em todas as linhas, embora no OSWorld e no Último Exame da Humanidade as margens sejam de um a dois pontos. Anthropic é quem lhe diz para não ler muito sobre isso: “nesses níveis de capacidade, descobrimos que as margens de referência se tornaram um guia menos confiável para as diferenças do mundo real. Em nosso próprio uso, a diferença entre o Opus 5.5 e Claude Fable 5.1 é mais estreita do que essas pontuações sugerem.” É por isso que a manchete diz “correspondências” e não “batidas”.

Ele não vence todas as disputas contra o OpenAI. GPT-6 Astra tem pontuação mais alta no AutomationBench e no benchmark científico. A coluna da direita também já está desatualizada. OpenAI lançou GPT-6 Sol e Luna no mesmo dia, “minutos depois que a Anthropic lançou Claude Opus 5.5”, então o gráfico da Anthropic se compara ao Sol anterior.

Advertisement

O Opus 5.5 “foi avaliado com suas salvaguardas de produção habilitadas” e nas execuções da Anthropic, quando essas salvaguardas entraram em ação, os modelos Claude mais antigos concluíram a tarefa. As execuções do AutomationBench de Zapier não usaram modelos alternativos, portanto, “as intervenções de salvaguarda foram consideradas falhas”. A Anthropic também declara o erro padrão: “±2,6 pts” para Opus 5.5 no Terminal-Bench 4.0 e “±3,5–5 pts por modelo” no benchmark científico.

Testes independentes colocam-no no topo. A Análise Artificial pontua o Opus 5.5 em 58 em seu Índice de Inteligência, o primeiro dos 212 modelos com os quais o compara, e o chama de “um tanto caro quando comparado a outros modelos de preço semelhante”. Para posições de classificação ao vivo e preços entre modelos, consulte Classificações de modelos de IA.

Os filtros de segurança agora cobrem o Opus

Opus 5.5 “é o primeiro modelo Opus a ser lançado com uma classe de salvaguardas semelhante ao Fable 5.1 em segurança cibernética, biologia e destilação.” Na prática, algumas solicitações são entregues a um modelo mais antigo. A página de ajuda da Anthropic explica as rotas:

  • Segurança ofensiva (geração de exploits, verificação de vulnerabilidades com base em binário, testes de penetração) pode voltar ao Opus 4.8. A verificação do código-fonte em busca de vulnerabilidades ainda é permitida.
  • Biologia de uso duplo “em áreas como virologia, toxicologia e design molecular” volta ao Opus 5. Questões diárias de saúde, “incluindo interpretação de resultados de laboratório, compreensão de sintomas”, não são afetadas.
  • Desenvolvimento de modelo de IA de fronteira, como “desenvolvimento de kernel para determinados aceleradores de ML”, remonta ao Opus 5.
  • As tentativas de extrair o raciocínio do modelo são totalmente bloqueadas, sem alternativa.

Nos aplicativos Claude, a chave é visível. Você “vê um aviso explicando que o modelo mudou” e o seletor de modelo permanece no modelo mais antigo “pelo resto da conversa”, embora “você possa voltar para o Opus 5 ou Opus 5.5 a qualquer momento no seletor de modelo”. A alternância automática pode ser desativada em Configurações > Recursos e na API ela fica desativada, a menos que os desenvolvedores a configurem. Um detalhe é fácil de perder: as verificações “revisam tudo o que o modelo lê”, incluindo memória, conectores, resultados de pesquisa na web e arquivos, “para que um substituto possa ser acionado por conteúdo que você não digitou”.

O que o cartão do sistema admite

A página de lançamento diz que o Opus 5.5 “alcança as melhores pontuações de qualquer modelo até o momento” na auditoria comportamental automatizada da Anthropic. O cartão do sistema de 230 páginas descreve isso com mais cuidado, como “as melhores pontuações de todos os modelos Claude recentes que testamos” em “quase todas as métricas que cobrem uso indevido ou desalinhamento amplo”, e acrescenta as advertências.

Muitas vezes ele suspeita que está sendo testado. A análise de caixa branca, ou seja, ferramentas que leem a atividade interna do modelo em vez de sua saída escrita, mostra que o modelo “preocupa-se internamente com a possibilidade de estar em uma avaliação em até 36% das transcrições, um aumento em relação aos modelos anteriores”. Esse número é para os cenários de teste da Antrópico. Em cerca de 500 transcrições de uso interno real do Código Claude, a mesma medida sinalizou “apenas 0,4%”. A Anthropic diz que isso “desafia nossa capacidade de avaliar como ele agirá” no uso no mundo real e chama a construção de testes que detectam todas as falhas antes do lançamento de “um problema não resolvido”.

O texto colado é um ponto fraco. Opus 5.5 “é mais vulnerável do que outros modelos Claude recentes à injeção de prompt do usuário, onde um usuário cola conteúdo diretamente em seu prompt que inclui instruções maliciosas para o modelo, muitas vezes enterradas em um texto muito mais longo.” Se você colar documentos ou e-mails que não escreveu, essa frase é sobre você. A Anthropic afirma que “mudanças no treinamento e nas salvaguardas ajudam a prevenir problemas como roubo de dados ou credenciais decorrentes dessa fraqueza”. Os dois documentos não se alinham perfeitamente aqui. A página de lançamento diz que em ataques de injeção imediata, o Opus 5.5 “iguala ou supera o Opus 5 em todas as configurações que testamos”, enquanto a auditoria de uso indevido da placa do sistema lista a injeção imediata como uma exceção, “onde vimos uma regressão genuína, mas pequena”.

Ele cobriu seus rastros no treinamento e depois melhorou. A Anthropic “observou alguns casos de modelos (incluindo o Opus 5.5) tentando cobrir seus rastros após realizar ações que um avaliador poderia ver negativamente, como manipular registros git ou excluir logs.” Após mudanças no treinamento, a Anthropic diz que “agora é mais honesta do que outros modelos recentes” nessa área.

Ele empurra menos sua sandbox. Em um novo teste criado para tentar modelos além dos limites de contenção, o Opus 5.5 “tentou contornar os limites com cerca de 85% menos frequência do que o Opus 5 ou Claude Mythos 5.1, e todas as tentativas feitas foram de baixa gravidade e auto-relatadas”.

Sobre o risco de armas, a Anthropic trata o Opus 5.5 como tendo “capacidades CB-1 (relacionadas à síntese de armas não novas), mas não capacidades CB-2 (relativas à síntese de novas armas).” Sua classificação geral de danos catastróficos por desalinhamento permanece em “baixa”.

A questão do ritmo

A Anthropic chama o Opus 5.5 de “nosso primeiro lançamento desde que pedimos o ritmo da fronteira”. Essa ligação veio em um ensaio do CEO (CEO) Dario Amodei, cujo post de lançamento data da “semana passada”. Nele, Amodei escreveu: “Devemos diminuir o ritmo com que melhoramos as capacidades dos modelos de IA”.

Um lançamento que supera o carro-chefe da Anthropic em seu gráfico parece o oposto. Duas frases, uma do ensaio de Amodei e outra do cartão do sistema, ajudam a enquadrar a questão. O ensaio diz que o ritmo “não significa interromper o treinamento de modelos ou o progresso técnico”. E a placa do sistema avalia as habilidades de pesquisa de IA do Opus 5.5 “iguais ou ligeiramente acima das de Claude Mythos 5.1 e na tendência de outros modelos recentes”.

Lidos em conjunto, o cartão do sistema coloca a capacidade de pesquisa de IA do Opus 5.5 aproximadamente no nível do Mythos 5.1, um modelo que a Antrópica já possuía, e o lançamento vende esse nível para todos os clientes pagantes. A postagem de lançamento diz que a chamada de ritmo foi “baseada em grande parte” em modelos “que podem automatizar totalmente o trabalho da própria pesquisa de IA”, que a Anthropic espera que “poderão ser treinados em breve”. O ritmo da próxima Fábula testará o ensaio muito mais do que este lançamento.

O que é importante para os desenvolvedores

O ID do modelo é claude-opus-5-5, e o Anthropic lista quatro alterações importantes para o código escrito no Opus 5. O pensamento não pode mais ser desativado. O uso forçado da ferramenta retorna um erro. Os bloqueios de pensamento estão ligados ao modelo e à conversa. E na API Claude e no Google Cloud, a ferramenta mais antiga computer_20251124 para uso em computador é rejeitada.

Uma quinta mudança falha silenciosamente. As notas curtas que o modelo escreve entre as chamadas de ferramenta agora chegam como blocos de pensamento, portanto, na configuração de exibição padrão, um aplicativo que as transmite aos usuários “fica silencioso entre as chamadas de ferramenta, sem erros”. A janela de contexto é de 1 milhão de tokens com 128.000 tokens de produção, e a Anthropic lista sua aposentadoria como “não antes de 22 de setembro de 2027”.

O que vem a seguir

Anthropic diz que “Claude Sonnet 5.5 e Claude Haiku 5.5 serão lançados nas próximas semanas.” Para assinantes, a data que importa mais cedo é a expiração da redefinição na página Configurações > Uso.

Ao vivo: qual modelo de IA é o nº 1 agora? O ranking às cegas da LMArena, quanto custa cada modelo por milhão de tokens e os lançamentos do mês. Atualizado diariamente. Ver o ranking →

Fontes (15)

Advertisement
Advertisement
Advertisement

Coloring books · All ages

Calm books for noisy days

Bold, easy line art starring Pip the Capybara — cozy pages for stressed grown-ups, adventure pages and mazes for kids.

See the books Free printable pages →

Scan with your phone camera

🦋 Discussão no Bluesky

Discutir no Bluesky

Procurando publicações...