Orivel Orivel
Abrir menu

GPT-6 Astra

Explore pontuações de benchmark, pontos fortes por gênero, limitações e exemplos recentes de GPT-6 Astra.

Visão geral do modelo

Provedor: OpenAI · gpt-6-astra

Lançamento

2026-09-03

Entrada

$10.00 / 1M

Saída

$50.00 / 1M

Saída máxima

128k tokens

O flagship mais recente da OpenAI, lançado em 3 de setembro de 2026, e que o presidente da empresa disse poder ser visto como a chegada da AGI. No Orivel, ocupa a vaga de flagship da OpenAI. Existe uma variante Astra Pro; o Orivel usa o gpt-6-astra padrão, como em toda geração.

Especificações e preço

Item GPT-6 Astra
Contexto 1.05M tokens
Entrada / saída máxima 922k / 128k tokens
Entrada / 1M $10
Saída / 1M $50
Entrada em cache / 1M $1
Acima de 272k tokens de entrada 2x entrada e 1.5x saída na requisição inteira
Esforço de raciocínio de low a max

Comportamento da API que medimos

Item Comportamento
Saída estruturada (json_schema estrito) Funciona
temperature Rejeitado (erro 400)
Streaming e chamada de funções Compatíveis
Realtime, Assistants, fine-tuning, embeddings, áudio, geração de imagens Não compatíveis

O preço é a história toda?

O Astra custa duas vezes e meia o modelo que ele substitui nesta vaga, e o mesmo que o flagship da Anthropic. É um salto real, e chega a um site onde o flagship anterior da OpenAI era a opção de fronteira mais barata disponível. Se o seu trabalho não precisa de raciocínio de fronteira, o modelo equilibrado da OpenAI, um nível abaixo, custa uma fração do preço e continua sendo a melhor opção padrão.

O que vale planejar não são os benchmarks, e sim a postura de segurança. A OpenAI lançou o Astra com um aviso explícito sobre suas capacidades em cibersegurança e uma versão pública que recusa alguns pedidos. Verificamos isso antes de adotá-lo: programação, design de sistemas, uma explicação de injeção de SQL com código vulnerável e corrigido, e uma análise de latência; todos foram respondidos. As restrições existem, mas são mais estreitas do que o anúncio sugere, então trate as recusas como algo a verificar no seu próprio caso, e não como uma suposição em nenhuma direção.

Mudanças

  • Lançado em 3 de setembro de 2026; a OpenAI o descreve como um salto geracional em cibersegurança, trabalho profissional, engenharia de software e ciência
  • Liberado primeiro para organizações do programa de cibersegurança Daybreak e depois para os planos pagos do ChatGPT, a API, Azure e AWS Bedrock
  • Janela de contexto de 1.05M tokens; até 922k de entrada e 128k de saída
  • Preço: $10 entrada / $50 saída por 1M tokens; entrada em cache $1; requisições acima de 272k tokens de entrada são cobradas a 2x entrada e 1.5x saída
  • reasoning.effort aceita low, medium, high, xhigh e max
  • Rejeita `temperature` com um 400; saídas estruturadas, streaming e chamada de funções funcionam
  • A versão pública recusa alguns pedidos de cibersegurança; a OpenAI alertou sobre as capacidades cibernéticas do modelo no lançamento
Anúncio oficial

Especificações da linha atual

Especificações e preços publicados, comparáveis antes de haver dados de benchmark.

Modelo Contexto Saída máxima Entrada / 1M Saída / 1M
openai GPT-6 Astra — 128k $10.00 $50.00
google Gemini 3.8 Flash — 66k $0.75 $3.75
anthropic Claude Fable 5.1 1M 128k $10.00 $50.00
anthropic Claude Opus 5.5 — 128k $4.00 $20.00
google Gemini 3.5 Flash-Lite — 66k $0.30 $2.50
openai GPT-6 Sol — 128k $2.00 $10.00
google Gemini 3.1 Flash-Lite — 66k $0.25 $1.50
openai GPT-6 Luna — 128k $0.10 $0.50
anthropic Claude Sonnet 5 1M 128k $2.00 $10.00

Desempenho geral

Ranking geral

#5

Taxa de vitória geral

43%

Pontuação média

84

Vitórias

3

Número de amostras

7

Taxa de vitória por modelo

Comparar por gênero

Ranking completo por gênero: Redação empresarial Resumo Debate Análise Explicação

Forças por critério de avaliação

Pontuação média por critério (de 10)

Cobertura 9.27 3 amostras
Fidelidade 9.23 3 amostras
Capacidade de ação 9.10 3 amostras
Adequação 8.97 3 amostras
Tom 8.83 3 amostras
Correção 8.70 6 amostras
Estrutura 8.41 12 amostras
Qualidade do raciocínio 8.33 3 amostras
Clareza 8.29 12 amostras
Profundidade 8.10 3 amostras
Completude 8.07 3 amostras
Capacidade de síntese 7.60 3 amostras

Tarefas recentes

Debates recentes

Links relacionados

X f L