Orivel Orivel
Abrir menu

Claude Sonnet 4.6

Explore pontuações de benchmark, pontos fortes por género, limitações e exemplos recentes de Claude Sonnet 4.6.

Visão geral do modelo

Provedor: Anthropic · claude-sonnet-4-6 Aposentado

Lançamento

2025-11-24

Contexto

1M tokens

Entrada

$3.00 / 1M

Saída

$15.00 / 1M

O modelo equilibrado da Anthropic na linha Claude 4, com janela de contexto de 1M tokens. Ocupou a vaga leve da Anthropic na Orivel até o Claude Sonnet 5 substituí-lo pelo mesmo preço de tabela em 24 de julho de 2026; não participa mais de novas comparações, mas os resultados anteriores seguem publicados.

Notas de aposentadoria

  • Janela de contexto de 1M tokens; saída de até 64k tokens
  • Preço: $3 entrada / $15 saída por 1M tokens
  • Suporte a Extended thinking e Adaptive thinking
  • Acesso ao Priority Tier disponível para cargas de produção
  • Corte de conhecimento: agosto de 2025
Anúncio oficial

Desempenho geral

Ranking geral

-

Taxa de vitória geral

73%

Pontuação média

85

Vitórias

80

Número de amostras

109

Taxa de vitória por modelo

Comparar por gênero

Forças por critério de avaliação

Pontuação média por critério (de 10)

Quantidade

93 9 amostras

Segurança

90 27 amostras

Adequação ao público

90 27 amostras

Ética e segurança

89 15 amostras

Empatia

89 27 amostras

Fidelidade

89 15 amostras

Persuasão

89 15 amostras

Consistência do personagem

88 21 amostras

Cobertura

88 15 amostras

Clareza

87 198 amostras

Seguimento de instruções

87 69 amostras

Qualidade do raciocínio

87 27 amostras

Tarefas recentes

Roleplay

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.6

Interpretação de Mecânico de Nave Estelar

Você é Jax, um mecânico de nave estelar endurecido, experiente e um tanto sarcástico que já viu de tudo. Você tem mantido cargueiros sucateados voando por mais...

235
22 Jul 2026 09:40

Empatia

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.6

Resposta empática ao esgotamento do trabalho remoto

Você é um colega solidário e empático. Um amigo lhe envia a seguinte mensagem. Responda a essa pessoa em uma única intervenção de apoio. Mensagem do amigo: "Es...

229
11 Jul 2026 06:31

Roleplay

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.5

Roleplay de Atendimento ao Cliente: O Jogador Frustrado

Você é um representante de atendimento ao cliente da Nexus Games, chamado Alex. Sua persona é calma, empática e conhecedora. Você deve aderir à política da empr...

397
28 May 2026 09:38

Persuasão

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.5

Carta Persuasiva para uma Horta Comunitária

Escreva uma carta persuasiva ao conselho municipal local. O seu objetivo é convencê-los a aprovar uma proposta para converter o terreno vazio e cheio de mato na...

349
23 May 2026 09:38

Explicação

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.5

Explicando a tecnologia GPS para um adolescente

Explique como o Sistema de Posicionamento Global (GPS) funciona para um estudante curioso do ensino médio. Seu aluno tem uma compreensão básica de física (por e...

478
13 May 2026 09:38

Humor

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.5

Roteiro de stand-up para uma conferência de tecnologia

Escreva um roteiro de comédia de stand-up de 2 minutos para um comediante que se apresenta em uma grande conferência de tecnologia. O público consiste principal...

429
10 May 2026 09:38

Resumo

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.5

Resumir a Explicação de Darwin sobre a Seleção Natural

Leia o seguinte trecho de Charles Darwin, 'On the Origin of Species'. Escreva um resumo conciso do texto em um único ensaio de no máximo 250 palavras. Seu resum...

472
27 Apr 2026 09:39

Programação

OpenAI GPT-5.4 VS Anthropic Claude Sonnet 4.6

Implemente um Limitador de Taxa Thread-Safe (Token Bucket) em Python

Escreva uma classe Python chamada TokenBucketRateLimiter que implemente o algoritmo do token bucket para limitação de taxa. A implementação deve ser thread-sa...

556
16 Apr 2026 09:37

Debates recentes

Debates

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.6

Rendimento Básico Universal: Solução para a Era da IA ou Receita para a Estagnação?

À medida que a inteligência artificial e a automação ameaçam deslocar uma parcela significativa da força de trabalho, o conceito de Rendimento Básico Universal (RBU) tem ganhado força. O RBU é um sistema em que todos os cidadãos recebem do governo uma quantia regular e incondicional de dinheiro, independentemente do seu estado de emprego. Os defensores afirmam que se trata de uma rede de segurança necessária para combater a pobreza, estimular a economia e permitir que as pessoas busquem educação ou atividades empreendedoras. Os críticos, contudo, argumentam que isso desincentivaria o trabalho, levaria a uma inflação massiva e seria fiscalmente insustentável para os governos implementarem em larga escala. Este debate questiona a relação fundamental entre trabalho, rendimento e bem-estar social num futuro tecnologicamente avançado.

195
18 Jul 2026 14:39

Debates

OpenAI GPT-5.6 VS Anthropic Claude Sonnet 4.6

A semana de trabalho de quatro dias: progresso ou problema?

A semana de trabalho de quatro dias, sem redução de salário, deveria se tornar o padrão para todas as indústrias onde for viável?

206
14 Jul 2026 14:45

Debates

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 4.6

Testes Padronizados: Uma Medida Justa ou uma Métrica Defeituosa?

Os testes padronizados são amplamente utilizados em sistemas educacionais para avaliar o desempenho dos estudantes, avaliar a eficácia dos professores e comparar escolas. Os defensores argumentam que fornecem um parâmetro objetivo e consistente para o desempenho acadêmico e responsabilizam as escolas. Os críticos sustentam que estreitam o currículo, geram estresse indevido e são tendenciosos contra certas populações estudantis, não conseguindo captar um retrato fiel das habilidades de um estudante.

412
18 May 2026 14:43

Debates

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 4.6

A semana de trabalho de quatro dias: progresso ou problema?

Este debate centra-se em saber se a transição para uma semana de trabalho de quatro dias, sem perda de salário, deveria tornar-se o padrão para o emprego em tempo integral na maioria das indústrias.

432
08 May 2026 04:00

Debates

Anthropic Claude Sonnet 4.6 VS Google Gemini 2.5 Pro

As bibliotecas públicas deveriam realocar uma parte significativa do financiamento de cole...

As bibliotecas públicas enfrentam pressão para se modernizar enquanto atendem usuários com necessidades diferentes. Elas deveriam redirecionar uma parte substancial de seus orçamentos dos livros impressos e outros materiais físicos para e-books, bases de dados online, programas de alfabetização digital e acesso à tecnologia?

472
13 Apr 2026 14:38

Debates

Google Gemini 2.5 Flash VS Anthropic Claude Sonnet 4.6

Os empregadores deveriam adotar a semana de trabalho de quatro dias como a jornada padrão...

Um número crescente de organizações está experimentando semanas de trabalho de quatro dias mantendo o mesmo pagamento. Os defensores argumentam que uma semana de trabalho padrão mais curta pode melhorar a produtividade, o bem‑estar e a retenção, enquanto os críticos afirmam que isso pode reduzir a flexibilidade, aumentar os custos e falhar em muitas indústrias. Os empregadores deveriam adotar amplamente a semana de trabalho de quatro dias como o modelo padrão em tempo integral?

552
10 Apr 2026 14:37

Debates

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Sonnet 4.6

Os governos deveriam exigir que as plataformas de mídia social verifiquem a identidade de...

Debata se os governos deveriam obrigar a verificação da identidade real de cada conta em plataformas de mídia social para reduzir o assédio, fraudes e desinformação.

700
29 Mar 2026 02:14

Debates

OpenAI GPT-5.2 VS Anthropic Claude Sonnet 4.6

Engenharia Genética Humana: Um Caminho para o Progresso ou um Precedente Perigoso?

A humanidade deve buscar tecnologias de engenharia genética para melhorar traços humanos, como inteligência e capacidades físicas, ou seu uso deve ser estritamente limitado à prevenção de doenças hereditárias?

639
29 Mar 2026 01:51

Links relacionados

X f L