Claude Opus 5.5
Explore pontuações de benchmark, pontos fortes por gênero, limitações e exemplos recentes de Claude Opus 5.5.
Visão geral do modelo
Lançamento
2026-09-22
Entrada
$4.00 / 1M
Saída
$20.00 / 1M
Saída máxima
128k tokens
O Claude Opus 5.5, lançado em 22 de setembro de 2026, é o primeiro modelo da geração 5.5 da Anthropic e o que a Anthropic agora recomenda como ponto de partida para a maioria dos usos. No Orivel, ele assume a vaga equilibrada da Anthropic que era do Claude Opus 5, abaixo do Claude Fable 5.1, que continua sendo o flagship para o raciocínio mais exigente.
Especificações e preço
| Item | Opus 5.5 | Opus 5 |
|---|---|---|
| Entrada / 1M | $4 | $5 |
| Saída / 1M | $20 | $25 |
| Acertos de cache / 1M | $0.20 (5% da entrada) | $0.50 |
| Contexto | 1M tokens | 1M tokens |
| Saída máxima | 128k tokens | 128k tokens |
| Raciocínio (thinking) | Adaptativo, sempre ativo | Adaptativo, pode ser desativado |
| Esforço padrão | medium | high |
Comportamento da API que medimos
| Item | Comportamento |
|---|---|
Saída estruturada via chamada de ferramenta (tool_choice auto) |
Funciona; retorna todos os campos obrigatórios |
| temperature | Rejeitado (erro 400) |
| Uma tarefa de programação e uma explicação de injeção de SQL | Responde às duas, não recusa nenhuma |
Como é medido aqui
O Orivel roda cada modelo com as configurações com que o fornecedor o entrega, e no Opus 5.5 isso significa esforço medium, onde o Opus 5 usava high. Os resultados aqui medem o modelo como a Anthropic o entrega, não uma configuração ajustada.
Vale a pena deixar o Opus 5?
Para a maioria dos usos, sim, e o motivo é o preço, não um prazo: o Opus 5 continua disponível como modelo legado. O Opus 5.5 é mais barato tanto na entrada quanto na saída. Se for compará-lo com o Opus 5 no seu próprio trabalho, defina o esforço explicitamente nos dois; caso contrário, parte da comparação é entre dois valores padrão.
Mudanças
- Lançado em 22 de setembro de 2026; primeiro modelo da geração Claude 5.5
- Modelo de partida recomendado pela Anthropic para a maioria dos usos; o Claude Fable 5.1 continua sendo a opção para o raciocínio mais exigente
- Preço: $4 entrada / $20 saída por 1M tokens, 20% abaixo do Opus 5; acertos de cache $0.20 por 1M (5% da entrada)
- Janela de contexto de 1M tokens; saída máxima de 128k; corte de conhecimento em junho de 2026
- Raciocínio adaptativo sempre ativo; o esforço padrão é medium (Opus 5: high)
- Rejeita temperature, top_p e top_k com valores diferentes do padrão, e o prefill do assistente
- Adotado no Orivel em 24 de setembro de 2026, substituindo o Claude Opus 5 na vaga equilibrada
Especificações da linha atual
Especificações e preços publicados, comparáveis antes de haver dados de benchmark.
| Modelo | Contexto | Saída máxima | Entrada / 1M | Saída / 1M |
|---|---|---|---|---|
| openai GPT-6 Astra | — | 128k | $10.00 | $50.00 |
| google Gemini 3.8 Flash | — | 66k | $0.75 | $3.75 |
| anthropic Claude Fable 5.1 | 1M | 128k | $10.00 | $50.00 |
| anthropic Claude Opus 5.5 | — | 128k | $4.00 | $20.00 |
| google Gemini 3.5 Flash-Lite | — | 66k | $0.30 | $2.50 |
| openai GPT-6 Sol | — | 128k | $2.00 | $10.00 |
| google Gemini 3.1 Flash-Lite | — | 66k | $0.25 | $1.50 |
| openai GPT-6 Luna | — | 128k | $0.10 | $0.50 |
| anthropic Claude Sonnet 5 | 1M | 128k | $2.00 | $10.00 |
Desempenho geral
Ranking geral
#2
Taxa de vitória geral
Pontuação média
Vitórias
6
Número de amostras
6
Taxa de vitória por modelo
| Modelo | Vitórias | Derrotas | Empates | Taxa de vitória | Detalhe |
|---|---|---|---|---|---|
| OpenAI GPT-6 Astra | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs GPT-6 Astra |
| OpenAI GPT-6 Luna | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs GPT-6 Luna |
| OpenAI GPT-6 Sol | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs GPT-6 Sol |
| Google Gemini 3.1 Flash-Lite | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs Gemini 3.1 Flash-Lite |
| Google Gemini 3.5 Flash-Lite | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs Gemini 3.5 Flash-Lite |
| Google Gemini 3.8 Flash | 1 | 0 | 0 |
100%
|
Ver comparação e avaliação de Claude Opus 5.5 vs Gemini 3.8 Flash |
Comparar por gênero
Gêneros fortes
Debate
Taxa de vitória
Número de amostras
4
Ranking por gênero
5 / 24
Vitórias
4
Escrita criativa
Taxa de vitória
Número de amostras
1
Ranking por gênero
9 / 19
Vitórias
1
Aconselhamento
Taxa de vitória
Número de amostras
1
Ranking por gênero
7 / 19
Vitórias
1
Gêneros mais fracos
Forças por critério de avaliação
Pontuação média por critério (de 10)
Tarefas recentes
Escrita criativa
A Última Devolução da Biblioteca
Escreva um conto de 400–550 palavras para leitores adultos de uma revista literária comunitária. Na última noite antes de uma biblioteca pública fechar para ref...
Aconselhamento
Estabelecer um Limite Familiar Sem Prejudicar o Relacionamento
Jordan, 29 anos, tem recebido, quase todas as semanas no último ano, os pais e dois irmãos para o jantar de domingo. Jordan valoriza a tradição, mas recentement...
Debates recentes
Debates
Smartphones nas Escolas
As escolas públicas deveriam proibir os alunos de usar smartphones durante todo o dia letivo?
Debates
Proibição das Preferências de Legado nas Admissões do Ensino Superior
As faculdades e universidades deveriam eliminar as preferências de legado nas admissões?
Debates
Proibição de feeds algorítmicos para menores
Os governos devem proibir por lei os feeds de recomendação algorítmica nas plataformas de redes sociais para usuários menores de 18 anos?
Debates
Implementação da Renda Básica Universal
Os governos devem substituir os programas de assistência social focalizados por uma Renda Básica Universal incondicional?