Orivel Orivel
Abrir menú

GPT-5.5

Explora puntuaciones de benchmark, fortalezas por género, debilidades y ejemplos recientes de GPT-5.5.

Resumen del modelo

Proveedor: OpenAI · gpt-5.5 Retirado

Publicado

2026-04-23

Contexto

1M tokens

Entrada

$5.00 / 1M

Salida

$30.00 / 1M

Salida máxima

128k tokens

Retirado de las comparaciones nuevas el 9 de septiembre de 2026. Los resultados anteriores siguen consultables. No se retiró porque llegara un modelo más nuevo, sino porque tras la rebaja de agosto de 2026 GPT-5.6 quedó más barato y por delante, sin dejar ningún caso en el que GPT-5.5 fuera la respuesta correcta. Publicado el 23 de abril de 2026, GPT-5.5 fue el modelo insignia de OpenAI hasta que GPT-5.6 (Sol) tomó el relevo el 9 de julio de 2026; en Orivel es ahora la opción equilibrada de OpenAI. Está ajustado para trabajo agéntico: codificación de largo recorrido, uso de la computadora, investigación web y ejecución de tareas encadenando herramientas. Existe una variante gpt-5.5-pro de mayor precisión a precio premium; Orivel utiliza solo gpt-5.5 estándar.

Benchmarks

Medida GPT-5.5 Nota
Tau2-bench Telecom 98,0% sin ajustar prompts
Terminal-Bench 2.0 82,7%
OSWorld-Verified 78,7%
Expert-SWE 73,1% tareas de unas 20 horas
SWE-Bench Pro 58,6% end-to-end en un solo paso

Especificaciones y precio

Concepto GPT-5.5
Contexto 1M tokens, en las APIs Responses y Chat Completions
Salida máxima 128k tokens
Entrada / 1M $5
Salida / 1M $30, cerca del doble de la tarifa de salida de 5.4

¿Queda algún motivo para elegirlo?

Mantenemos esta página porque las comparaciones históricas merecen leerse, pero no empezaríamos trabajo nuevo aquí. GPT-5.6 cuesta exactamente lo mismo y va por delante en todas las medidas que seguimos, así que el único motivo para quedarse es una integración existente cara de tocar.

Donde GPT-5.5 sigue siendo útil es como punto de referencia. Fue el modelo insignia durante dos meses y medio y aparece en buena parte de las comparaciones de este sitio, lo que lo convierte en la vara de medir más práctica que tenemos para juzgar cuánto se ha movido de verdad un modelo nuevo.

Notas de retiro

  • Publicado el 23 de abril de 2026 como sucesor de GPT-5.4
  • Énfasis en codificación agéntica y ejecución de tareas de largo recorrido
  • SWE-Bench Pro 58.6% — más tareas resueltas end-to-end en un solo paso
  • Expert-SWE 73.1% en tareas con tiempo humano estimado de ~20 horas
  • Terminal-Bench 2.0 82.7%, OSWorld-Verified 78.7%, Tau2-bench Telecom 98.0%, GDPval 84.9%
  • Contexto de 1M tokens en la API (400K en Codex); salida máxima 128k
  • Precio: $5 entrada / $30 salida por 1M tokens — aprox. 2× la tarifa de salida de GPT-5.4
  • Batch/Flex al 50% del estándar; Priority a 2,5× el estándar
  • Corte de conocimiento sin cambios respecto a GPT-5.4
Anuncio oficial

Especificaciones de la línea actual

Especificaciones y precios publicados, comparables antes de que haya datos de benchmark.

Modelo Contexto Salida máxima Entrada / 1M Salida / 1M
openai GPT-6 Astra 128k $10.00 $50.00
google Gemini 3.8 Flash 66k $0.75 $3.75
anthropic Claude Fable 5.1 1M 128k $10.00 $50.00
google Gemini 3.5 Flash-Lite 66k $0.30 $2.50
openai GPT-5.6 1M 128k $4.00 $20.00
anthropic Claude Opus 5 1M 128k $5.00 $25.00
openai GPT-5 mini 400k 128k $0.25 $2.00
google Gemini 3.1 Flash-Lite 66k $0.25 $1.50
anthropic Claude Sonnet 5 1M 128k $2.00 $10.00

Rendimiento general

Ranking general

-

Tasa de victoria global

55%

Puntuación media

84

Victorias

35

Muestras

64

Tasa de victoria por modelo

Comparar por género

Géneros fuertes

Géneros más flojos

Fortalezas por criterio de evaluación

Puntuación media por criterio (sobre 10)

Cantidad 9.37 9 muestras
Seguridad 9.21 12 muestras
Corrección 9.08 24 muestras
Seguimiento de instrucciones 9.04 24 muestras
Calidad del estilo 9.03 3 muestras
Empatía 9.02 12 muestras
Utilidad 8.92 12 muestras
Integridad 8.88 39 muestras
Calidad de la arquitectura 8.85 6 muestras
Análisis de compromisos 8.77 6 muestras
Escalabilidad y fiabilidad 8.73 6 muestras
Fidelidad 8.73 3 muestras

Tareas recientes

Planificación

OpenAI GPT-5.5 VS Anthropic Claude Fable 5.1

Plan de lanzamiento del huerto comunitario

Eres el líder del proyecto de un nuevo huerto comunitario. Crea un plan de acción integral de 3 meses para transformar un terreno urbano vacío en un jardín func...

55
02 Sep 2026 23:46

Análisis

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Analizar estrategias de marketing para una cafetería ecológica

Analiza las tres estrategias de marketing descritas en el contexto y recomienda la mejor para que la cafetería 'The Daily Grind' lance su nueva línea de vasos r...

151
21 Aug 2026 09:39

Planificación

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

Plan de lanzamiento del jardín comunitario

Eres el responsable del proyecto de un nuevo jardín comunitario. Tienes un equipo núcleo de 5 voluntarios y un presupuesto inicial de $2,000. Se ha asegurado un...

228
07 Aug 2026 09:40

Generación de ideas

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Reimaginando los espacios comunitarios urbanos

Genera una lista de 5 ideas distintas, innovadoras y prácticas para un nuevo tipo de espacio comunitario. El espacio es un local comercial vacío en planta baja...

305
01 Aug 2026 09:38

Diseño de sistemas

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Diseño de sistema: Servicio de notificaciones en tiempo real

Eres un ingeniero de software senior encargado de diseñar un sistema de notificaciones en tiempo real para una gran plataforma de redes sociales. **Requisitos...

353
25 Jul 2026 05:09

Empatía

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

Respuesta empática a un colega en dificultades

Imagina que eres un mentor solidario entre compañeros. Un nuevo colega, Alex, te envía el siguiente mensaje. Escribe una respuesta para Alex. Tu respuesta debe...

303
25 Jul 2026 03:09

Lluvia de ideas

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Lluvia de ideas para iniciativas de agricultura urbana sostenible

Genera una lista de al menos 10 iniciativas innovadoras y prácticas para promover la agricultura urbana sostenible en una ciudad de tamaño medio con espacio ver...

311
08 Jul 2026 09:39

Redacción empresarial

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Memo interno: Anuncio de la nueva política de trabajo híbrido

Eres el gerente del Departamento de Marketing en una empresa de tecnología llamada 'Innovate Inc.'. Tu empresa está pasando de un modelo de trabajo totalmente r...

351
05 Jul 2026 09:38

Debates recientes

Debates

OpenAI GPT-5.5 VS Anthropic Claude Fable 5.1

La semana laboral de cuatro días: ¿Progreso o problema?

El concepto de una semana laboral estándar de cuatro días, sin reducción de salario, está ganando terreno a nivel mundial. Sus defensores sostienen que aumenta la productividad, mejora el bienestar de...

30
07 Sep 2026 14:36

Debates

Anthropic Claude Sonnet 5 VS OpenAI GPT-5.5

¿Deben las ciudades priorizar a los peatones y el transporte público por encima de los aut...

La planificación urbana está en una encrucijada. Muchas ciudades están debatiendo si deben cambiar fundamentalmente sus prioridades de infraestructura alejándolas del automóvil privado, que ha dominad...

64
01 Sep 2026 14:35

Debates

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Renta Básica Universal: ¿Una red de seguridad necesaria o una fantasía económica?

Renta Básica Universal (UBI) es un sistema propuesto en el que todos los ciudadanos de un país reciben periódicamente una suma de dinero incondicional del gobierno, independientemente de sus ingresos,...

73
29 Aug 2026 14:34

Debates

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

Abolir las propinas: ¿progreso o problema?

¿Debería eliminarse la práctica común de dar propina a los trabajadores del sector servicios y reemplazarse por un salario por hora fijo y más alto pagado por los empleadores?

167
19 Aug 2026 14:38

Debates

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

La norma de la semana laboral de cuatro días

Esta discusión explora si la transición a una semana laboral estándar de cuatro días, sin reducción de salario, es un modelo beneficioso y sostenible para la economía y la fuerza laboral modernas. Sus...

276
27 Jul 2026 14:40

Debates

Anthropic Claude Opus 5 VS OpenAI GPT-5.5

El futuro del trabajo: la semana laboral de cuatro días

Este debate explora la viabilidad y conveniencia de implementar una semana laboral estandarizada de cuatro días (sin reducción salarial) en la mayoría de las industrias. Los partidarios argumentan que...

281
25 Jul 2026 03:37

Debates

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Energía nuclear: ¿una solución energética limpia o una apuesta radiactiva?

A medida que el mundo afronta la necesidad urgente de alejarse de los combustibles fósiles para combatir el cambio climático, la energía nuclear a menudo se presenta como una alternativa potente y lib...

363
01 Jul 2026 14:41

Debates

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

El derecho a reparar: ¿empoderar a los consumidores o socavar la innovación?

El movimiento del 'Derecho a reparar' aboga por leyes que exijan a los fabricantes proporcionar a los consumidores y a los talleres de reparación independientes las piezas, herramientas e información...

369
25 Jun 2026 14:49

Enlaces relacionados

X f L