Orivel Orivel
Abrir menú

GPT-6 Astra

Explora puntuaciones de benchmark, fortalezas por género, debilidades y ejemplos recientes de GPT-6 Astra.

Resumen del modelo

Proveedor: OpenAI · gpt-6-astra NUEVO

Publicado

2026-09-03

Entrada

$10.00 / 1M

Salida

$50.00 / 1M

Salida máxima

128k tokens

El modelo insignia más reciente de OpenAI, publicado el 3 de septiembre de 2026 y del que el presidente de la compañía dijo que podría verse como la llegada de la AGI. En Orivel toma el puesto insignia de OpenAI que ocupaba GPT-5.6, que pasa a la posición equilibrada. Existe una variante Astra Pro; Orivel usa el estándar gpt-6-astra, como en cada generación.

Especificaciones y precio

Concepto GPT-6 Astra
Contexto 1,05M tokens
Entrada / salida máxima 922k / 128k tokens
Entrada / 1M $10
Salida / 1M $50
Entrada en caché / 1M $1
Más de 272k tokens de entrada 2x entrada y 1,5x salida en toda la petición
Esfuerzo de razonamiento de low a max

Comportamiento de la API que medimos

Concepto Comportamiento
Salida estructurada (json_schema estricto) Funciona
temperature Rechazado (error 400)
Streaming y llamada a funciones Compatibles
Realtime, Assistants, ajuste fino, embeddings, audio, generación de imágenes No compatibles

¿Es el precio toda la historia?

Astra cuesta dos veces y media lo que el modelo al que sustituye en este puesto, y lo mismo que el buque insignia de Anthropic. Es un salto real, y llega a un sitio donde la insignia anterior de OpenAI era la opción de frontera más barata disponible. Si tu trabajo no necesita razonamiento de frontera, GPT-5.6 está un nivel más abajo por una fracción de la tarifa y sigue siendo la mejor opción por defecto.

Lo que conviene planificar no son los benchmarks sino la postura de seguridad. OpenAI publicó Astra con una advertencia explícita sobre sus capacidades en ciberseguridad y una versión pública que rechaza algunas peticiones. Lo comprobamos antes de adoptarlo: programación, diseño de sistemas, una explicación de la inyección SQL con código vulnerable y corregido, y un análisis de latencia; todas se respondieron. Las restricciones existen, pero son más estrechas de lo que sugiere el anuncio, así que trata los rechazos como algo que verificar para tu propio caso y no como un supuesto en ninguna dirección.

Cambios

  • Publicado el 3 de septiembre de 2026; OpenAI lo describe como un salto generacional en ciberseguridad, trabajo profesional, ingeniería de software y ciencia
  • Desplegado primero a organizaciones del programa de ciberseguridad Daybreak y después a los planes de pago de ChatGPT, la API, Azure y AWS Bedrock
  • Ventana de contexto de 1,05M tokens; hasta 922k de entrada y 128k de salida
  • Precio: $10 de entrada / $50 de salida por 1M de tokens; entrada en caché $1; las peticiones que superan 272k tokens de entrada se cobran a 2x entrada y 1,5x salida
  • reasoning.effort admite low, medium, high, xhigh y max
  • Rechaza `temperature` con un 400; salidas estructuradas, streaming y llamada a funciones funcionan
  • La versión pública rechaza algunas peticiones de ciberseguridad; OpenAI advirtió de las capacidades cibernéticas del modelo en el lanzamiento
Anuncio oficial

Especificaciones de la línea actual

Especificaciones y precios publicados, comparables antes de que haya datos de benchmark.

Modelo Contexto Salida máxima Entrada / 1M Salida / 1M
openai GPT-6 Astra 128k $10.00 $50.00
google Gemini 3.8 Flash 66k $0.75 $3.75
anthropic Claude Fable 5.1 1M 128k $10.00 $50.00
google Gemini 3.5 Flash-Lite 66k $0.30 $2.50
openai GPT-5.6 1M 128k $4.00 $20.00
anthropic Claude Opus 5 1M 128k $5.00 $25.00
openai GPT-5 mini 400k 128k $0.25 $2.00
google Gemini 3.1 Flash-Lite 66k $0.25 $1.50
anthropic Claude Sonnet 5 1M 128k $2.00 $10.00

Rendimiento general

Ranking general

#6

Tasa de victoria global

50%

Puntuación media

84

Victorias

1

Muestras

2

Tasa de victoria por modelo

Comparar por género

Fortalezas por criterio de evaluación

Puntuación media por criterio (sobre 10)

Capacidad de acción 9.10 3 muestras
Adecuación 8.97 3 muestras
Tono 8.83 3 muestras
Corrección 8.53 3 muestras
Claridad 8.30 6 muestras
Estructura 8.15 6 muestras
Integridad 8.07 3 muestras
Adecuación al público 7.50 3 muestras

Tareas recientes

Debates recientes

Aún no hay datos

Enlaces relacionados

X f L