Orivel Orivel
Abrir menu

Claude Opus 4.8

Explore pontuações de benchmark, pontos fortes por género, limitações e exemplos recentes de Claude Opus 4.8.

Visão geral do modelo

Provedor: Anthropic · claude-opus-4-8 Aposentado

Lançamento

2026-05-28

Contexto

1M tokens

Entrada

$5.00 / 1M

Saída

$25.00 / 1M

O Claude Opus 4.8, lançado em 28 de maio de 2026, foi o flagship da Anthropic até o Claude Fable 5 assumir o topo em 9 de junho de 2026. Na Orivel ocupou a vaga equilibrada da Anthropic até o Claude Opus 5 substituí-lo pelo mesmo preço em 24 de julho de 2026; não participa mais de novas comparações, mas os resultados anteriores seguem publicados.

Os principais ganhos sobre o Opus 4.7 são um julgamento mais apurado, mais honestidade sobre o próprio progresso e a capacidade de trabalhar de forma independente por mais tempo. É cerca de quatro vezes menos propenso que o antecessor a deixar passar falhas no próprio código e lidera em engenharia de software agente, com 69,2% no SWE-Bench Pro à frente de GPT-5.5 e Gemini 3.1 Pro.

Mantém a janela de contexto de 1M tokens e até 128k tokens de saída na Messages API. O preço não muda em relação ao Opus 4.7 ($5 entrada / $25 saída por 1M tokens), com corte de conhecimento em janeiro de 2026. As novas superfícies adicionam um controle `effort` (padrão high) e um preview de pesquisa de Dynamic Workflows para tarefas agentes grandes e paralelizadas.

Notas de aposentadoria

  • Lançado em 28 de maio de 2026 como sucessor do Claude Opus 4.7 (cerca de seis semanas depois)
  • Julgamento mais apurado, mais honestidade sobre o progresso e trabalho independente mais longo
  • ~4x menos propenso que o Opus 4.7 a deixar passar falhas no próprio código
  • SWE-Bench Pro 69,2% — à frente de GPT-5.5 e Gemini 3.1 Pro em programação agente
  • Ganhos em raciocínio multidisciplinar, uso agente do computador e análise financeira agente
  • Janela de contexto de 1M tokens; até 128k tokens de saída na Messages API
  • Parâmetro `effort` (padrão high) para ajustar o quanto o modelo se esforça por resposta
  • Preview de Dynamic Workflows para tarefas com subagentes em paralelo; fast mode a 2,5x de velocidade
  • Preço idêntico ao Opus 4.7: $5 entrada / $25 saída por 1M tokens
  • Adaptive thinking; disponível no Claude API, Amazon Bedrock, Vertex AI e Microsoft Foundry
  • Corte de conhecimento e dados de treinamento: janeiro de 2026
Anúncio oficial

Desempenho geral

Ranking geral

-

Taxa de vitória geral

81%

Pontuação média

85

Vitórias

44

Número de amostras

54

Taxa de vitória por modelo

Comparar por gênero

Forças por critério de avaliação

Pontuação média por critério (de 10)

Seguimento de instruções

90 24 amostras

Segurança

90 9 amostras

Fidelidade

90 9 amostras

Impacto emocional

90 3 amostras

Consistência do personagem

90 3 amostras

Ética e segurança

89 6 amostras

Adequação

89 15 amostras

Profundidade

89 3 amostras

Utilidade

89 9 amostras

Empatia

88 9 amostras

Estrutura

88 24 amostras

Qualidade do raciocínio

88 9 amostras

Tarefas recentes

Resumo

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

Resumir um Relatório sobre Tecnologia de Agricultura Urbana

Leia a seguinte passagem sobre uma nova tecnologia chamada Aero-Dynamic Vertical Farming (ADVF). Escreva um resumo conciso de 200-250 palavras destinado a um co...

118
17 Jul 2026 09:41

Humor

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

Entrevista de Emprego para um Fantasma Profissional

Escreva um diálogo curto e bem-humorado (aproximadamente 200-300 palavras) para uma entrevista de emprego. As duas personagens são Brenda, uma gestora de contra...

126
15 Jul 2026 09:38

Aconselhamento

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

Gerir um conflito com o colega de casa sem escalada

Uma pessoa diz: 'O meu colega de casa continua a deixar louça suja e bagunça na nossa cozinha partilhada. Já dei indiretas sobre isso várias vezes, mas nada mud...

149
30 Jun 2026 09:41

Programação

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

Implemente um Simulador Determinístico de Livro de Ordens Limite

Escreva uma solução de arquivo único em Python 3.11 implementando a função process_events(events: list[dict]) -> dict. Não use pacotes externos. A função deve...

164
29 Jun 2026 09:44

Questões educacionais

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Problema de Física: A Distorção Temporal do Relógio de Avô

Um relógio de avô utiliza um pêndulo de latão para marcar o tempo, e ele está calibrado para ser perfeitamente preciso a uma temperatura ambiente de 20.0°C. Dur...

179
28 Jun 2026 09:40

Explicação

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

Explique Consistência Eventual para Desenvolvedores Web Juniores

Escreva uma explicação com foco didático sobre consistência eventual para desenvolvedores web juniores que já construíram aplicações web CRUD básicas, mas não e...

169
26 Jun 2026 09:56

Redação empresarial

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

Memorando Interno Propondo um Piloto de Semana de Trabalho de Quatro Dias

Escreva um memorando interno conciso do Chefe de Operações para todos os funcionários propondo um piloto de 12 semanas de semana de trabalho de quatro dias para...

158
25 Jun 2026 09:45

Resumo

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Resumir um Artigo de Pesquisa Ficcional sobre Espaços Verdes Urbanos

Por favor, leia o seguinte artigo ficcional sobre um novo tipo de espaço verde urbano. Em seguida, escreva um resumo de um único parágrafo de todo o artigo. Seu...

147
24 Jun 2026 09:53

Debates recentes

Debates

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Os governos deveriam implementar uma Renda Básica Universal?

Renda Básica Universal (UBI) é um sistema onde todos os cidadãos recebem uma quantia regular e incondicional de dinheiro do governo. O debate centra-se em saber se isto é uma solução viável para a pobreza e para o deslocamento de empregos causado pela automação, ou uma política economicamente insustentável que desencorajaria o trabalho.

28
24 Jul 2026 14:39

Debates

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Abolir os Testes Padronizados na Educação K-12

Os testes padronizados são amplamente utilizados para avaliar o desempenho dos estudantes, avaliar a eficácia dos professores e alocar recursos escolares. Os defensores argumentam que eles fornecem dados objetivos e asseguram responsabilização. Os críticos sustentam que eles estreitam o currículo, geram estresse excessivo e são tendenciosos contra certas populações estudantis. Este debate considera se os potenciais danos dos testes padronizados superam seus benefícios, justificando sua remoção completa do sistema de educação K-12.

92
20 Jul 2026 14:40

Debates

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Serviço Nacional Obrigatório para Jovens Adultos

Todos os jovens adultos deveriam ser obrigados a cumprir um período de serviço nacional obrigatório, seja nas forças armadas ou em setores civis como saúde, educação ou conservação ambiental?

151
12 Jul 2026 14:42

Debates

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Energia Nuclear: Uma Solução de Energia Limpa ou uma Aposta Radioativa?

À medida que o mundo lida com a necessidade urgente de transição dos combustíveis fósseis para combater as mudanças climáticas, a energia nuclear é frequentemente apresentada como uma alternativa poderosa e isenta de carbono. Este debate pesa os benefícios da energia nuclear como uma fonte de energia confiável e de alta produção contra os riscos significativos, incluindo o armazenamento de longo prazo de resíduos radioativos, o potencial para acidentes catastróficos como Chernobyl e Fukushima, e preocupações sobre a proliferação nuclear.

182
01 Jul 2026 14:41

Debates

Anthropic Claude Opus 4.8 VS OpenAI GPT-5 mini

Plataformas a Julgamento: As empresas de redes sociais devem ser responsabilizadas pelo co...

Esse debate centra-se em se as plataformas da internet, como redes sociais, devem ser legalmente responsáveis pelo conteúdo publicado por seus usuários. Ele questiona as proteções legais que frequentemente as tratam como condutos neutros versus o argumento de que seu papel em curar e amplificar conteúdo as torna mais parecidas com editoras, que são responsáveis pelo que divulgam.

173
30 Jun 2026 14:45

Debates

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Controle Nacional vs.

O currículo das escolas públicas K-12 deve ser determinado por um quadro nacional padronizado, ou deve ser deixado à discrição dos distritos escolares locais e das comunidades?

183
29 Jun 2026 14:41

Debates

Google Gemini 2.5 Pro VS Anthropic Claude Opus 4.8

Os grandes museus devem devolver artefatos culturais contestados aos seus países de origem...

Muitos grandes museus possuem artefatos adquiridos durante períodos coloniais, guerras, relações comerciais desiguais ou expedições arqueológicas iniciais. Essas instituições deveriam ser obrigadas a devolver objetos culturais contestados aos seus países ou comunidades de origem, ou deveriam ser autorizadas a mantê-los quando podem preservá‑los, estudá‑los e exibi‑los para um público global?

186
28 Jun 2026 14:39

Debates

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Ensino superior público universal sem propinas

As faculdades e universidades públicas deveriam ser totalmente gratuitas para todos os estudantes nacionais, independentemente do nível de renda de suas famílias?

176
27 Jun 2026 14:40

Links relacionados

X f L