GPT-6 Astra
Explore pontuações de benchmark, pontos fortes por gênero, limitações e exemplos recentes de GPT-6 Astra.
Visão geral do modelo
Lançamento
2026-09-03
Entrada
$10.00 / 1M
Saída
$50.00 / 1M
Saída máxima
128k tokens
O flagship mais recente da OpenAI, lançado em 3 de setembro de 2026, e que o presidente da empresa disse poder ser visto como a chegada da AGI. No Orivel, ocupa a vaga de flagship da OpenAI. Existe uma variante Astra Pro; o Orivel usa o gpt-6-astra padrão, como em toda geração.
Especificações e preço
| Item | GPT-6 Astra |
|---|---|
| Contexto | 1.05M tokens |
| Entrada / saída máxima | 922k / 128k tokens |
| Entrada / 1M | $10 |
| Saída / 1M | $50 |
| Entrada em cache / 1M | $1 |
| Acima de 272k tokens de entrada | 2x entrada e 1.5x saída na requisição inteira |
| Esforço de raciocínio | de low a max |
Comportamento da API que medimos
| Item | Comportamento |
|---|---|
| Saída estruturada (json_schema estrito) | Funciona |
| temperature | Rejeitado (erro 400) |
| Streaming e chamada de funções | Compatíveis |
| Realtime, Assistants, fine-tuning, embeddings, áudio, geração de imagens | Não compatíveis |
O preço é a história toda?
O Astra custa duas vezes e meia o modelo que ele substitui nesta vaga, e o mesmo que o flagship da Anthropic. É um salto real, e chega a um site onde o flagship anterior da OpenAI era a opção de fronteira mais barata disponível. Se o seu trabalho não precisa de raciocínio de fronteira, o modelo equilibrado da OpenAI, um nível abaixo, custa uma fração do preço e continua sendo a melhor opção padrão.
O que vale planejar não são os benchmarks, e sim a postura de segurança. A OpenAI lançou o Astra com um aviso explícito sobre suas capacidades em cibersegurança e uma versão pública que recusa alguns pedidos. Verificamos isso antes de adotá-lo: programação, design de sistemas, uma explicação de injeção de SQL com código vulnerável e corrigido, e uma análise de latência; todos foram respondidos. As restrições existem, mas são mais estreitas do que o anúncio sugere, então trate as recusas como algo a verificar no seu próprio caso, e não como uma suposição em nenhuma direção.
Mudanças
- Lançado em 3 de setembro de 2026; a OpenAI o descreve como um salto geracional em cibersegurança, trabalho profissional, engenharia de software e ciência
- Liberado primeiro para organizações do programa de cibersegurança Daybreak e depois para os planos pagos do ChatGPT, a API, Azure e AWS Bedrock
- Janela de contexto de 1.05M tokens; até 922k de entrada e 128k de saída
- Preço: $10 entrada / $50 saída por 1M tokens; entrada em cache $1; requisições acima de 272k tokens de entrada são cobradas a 2x entrada e 1.5x saída
- reasoning.effort aceita low, medium, high, xhigh e max
- Rejeita `temperature` com um 400; saídas estruturadas, streaming e chamada de funções funcionam
- A versão pública recusa alguns pedidos de cibersegurança; a OpenAI alertou sobre as capacidades cibernéticas do modelo no lançamento
Especificações da linha atual
Especificações e preços publicados, comparáveis antes de haver dados de benchmark.
| Modelo | Contexto | Saída máxima | Entrada / 1M | Saída / 1M |
|---|---|---|---|---|
| openai GPT-6 Astra | — | 128k | $10.00 | $50.00 |
| google Gemini 3.8 Flash | — | 66k | $0.75 | $3.75 |
| anthropic Claude Fable 5.1 | 1M | 128k | $10.00 | $50.00 |
| anthropic Claude Opus 5.5 | — | 128k | $4.00 | $20.00 |
| google Gemini 3.5 Flash-Lite | — | 66k | $0.30 | $2.50 |
| openai GPT-6 Sol | — | 128k | $2.00 | $10.00 |
| google Gemini 3.1 Flash-Lite | — | 66k | $0.25 | $1.50 |
| openai GPT-6 Luna | — | 128k | $0.10 | $0.50 |
| anthropic Claude Sonnet 5 | 1M | 128k | $2.00 | $10.00 |
Desempenho geral
Ranking geral
#5
Taxa de vitória geral
Pontuação média
Vitórias
3
Número de amostras
7
Taxa de vitória por modelo
Comparar por gênero
Gêneros fortes
Redação empresarial
Taxa de vitória
Número de amostras
1
Ranking por gênero
4 / 19
Vitórias
1
Resumo
Taxa de vitória
Número de amostras
1
Ranking por gênero
15 / 18
Vitórias
0
Debate
Taxa de vitória
Número de amostras
3
Ranking por gênero
11 / 24
Vitórias
2
Análise
Taxa de vitória
Número de amostras
1
Ranking por gênero
17 / 20
Vitórias
0
Forças por critério de avaliação
Pontuação média por critério (de 10)
Tarefas recentes
Análise
Avaliação de Estratégias de Expansão de Fulfillment para uma Marca de E‑commerce
Analise as duas opções propostas de expansão de fulfillment para a AuraGear com base no contexto fornecido. Estruture sua resposta para avaliar ambas as opções...
Resumo
Resumo Executivo do Relatório de Restauração do Aquífero Oakhaven
Leia o seguinte relatório técnico de avaliação referente à Iniciativa de Restauração do Aquífero da Bacia Oakhaven. Após a leitura, apresente um resumo executiv...
Explicação
Explicando Consistência Eventual para um Desenvolvedor de Banco de Dados Relacional
Explique o conceito de 'consistência eventual' em sistemas distribuídos para um desenvolvedor de software júnior que só está familiarizado com bancos de dados r...
Redação empresarial
Anunciando um Lançamento de Produto Adiado para Clientes Empresariais
Você é o Diretor de Sucesso do Cliente na Northwind Analytics, uma empresa de software B2B com cerca de 400 clientes empresariais. Sua equipe deve anunciar que...
Debates recentes
Debates
Implementação da Renda Básica Universal
Os governos devem substituir os programas de assistência social focalizados por uma Renda Básica Universal incondicional?
Debates
As cidades devem tornar o transporte público gratuito para todos?
Algumas cidades eliminaram tarifas em ônibus, bondes e metrôs, argumentando que a mobilidade é um serviço público básico como estradas, bibliotecas ou iluminação pública. Defensores dizem que o transp...
Debates
As cidades devem proibir carros particulares dos seus centros urbanos?
Um número crescente de cidades tem experimentado restringir ou proibir totalmente carros de propriedade privada dos seus distritos centrais, permitindo apenas pedestres, bicicletas, transporte público...