- Nuevo flagship y mayor capacidad bajo demanda
- Programmatic Tool Calling y niveles de effort configurables
GPT-5.5
El flagship actual de OpenAI. Pensado para programación, investigación y análisis de datos complejos con múltiples herramientas. Persistente y más fiable que 5.4. También puede generar imágenes vía el módulo ChatGPT Image 2 — ver gpt-image-2 para detalle.
- Raziel Score
- 0.0/10
- API
- $5.00 / $30.00por millón de tokens
- Ventana de contexto
- 1M tokens
- Comunidad
- Sin datos aún
¿Para qué sí? ¿Para qué no?
Mejor para
- Agentes con herramientasCoordinar APIs, terminal, navegación y otras herramientas en varios pasos.
- Programación agénticaResolver issues y modificar repositorios con autonomía y herramientas.
- Investigación profundaBuscar, contrastar y sintetizar información de varias fuentes.
- Análisis de datosInterpretar datos, tablas y resultados mediante código o herramientas.
Evitar para
- Presupuesto ajustadoPriorizar coste total bajo frente al máximo rendimiento absoluto.
- Automatización simpleClasificar, extraer, enrutar o formatear tareas repetitivas.
Valoración por categoría
Matiz, estilo y creatividad
Comprensión, generación o edición visual
Benchmarks traducidos
Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.
Programación
Resultado de primera línea en esta prueba
Mide flujos de terminal agénticos en la versión 2.1; Raziel separa protocolos y harnesses.
Resultado alto, cerca de los mejores
Muy competitivo en coding agéntico profesional.
Trabajo profesional
Puntuación propia del benchmark: aquí, cuanto más alto, mejor
Calidad de entregables profesionales evaluada mediante comparaciones ciegas.
Agentes y herramientas
Resultado bajo para una prueba exigente
Uso autónomo de interfaces de ordenador bajo la versión 2.0.
Resultado de primera línea en esta prueba
Búsqueda web multi-paso para encontrar información difícil.
Razonamiento
Ciencia y salud
Resultado bajo para una prueba exigente
Análisis cuantitativo y flujos de investigación genómica.
Buen resultado, sin destacar en esta prueba
Tareas realistas de investigación en ciencias de la vida.
¿Dónde se puede ejecutar?
Modelo cerrado: disponible mediante web o API, sin ejecución local publicada.
Resumen práctico de las formas razonables de usar este modelo.
Lo usas desde una web, app o API. No instalas el modelo en tu equipo.
Para correrlo completo necesitas GPU profesional o una máquina grande.
Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.
Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.
Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.
Más detallesCerrarAbrir
Ficha técnica
Acceso y apps
Dónde puedes usarlo sin entrar en detalles de hardware.
No publicada
El proveedor no publica la arquitectura de este modelo.
La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.
Proprietary
- Uso comercialSin modificacionesSin atribución
Notas
API only. No weights available. OpenAI no publica arquitectura del modelo.
Fuentes
Revisado: 2026-07-13Historia del modelo
Este modelo tiene versiones más recientes. Aparecen primero para que puedas abrir su ficha.
- 2026jul
- 2026jul
- Tier equilibrado con rendimiento competitivo frente a GPT-5.5
- Programmatic Tool Calling y niveles de effort configurables
- 2026jul
- Tier más rápido y asequible
- Programmatic Tool Calling y niveles de effort configurables
- 2026abrSalto mayorEste modelo
GPT-5.5
- Persistente en tareas multi-step
- Mejor en programación y uso de herramientas
- Terminal-Bench 82.7%
- 2026mar
- Integra capacidades Codex
- Native Computer Use
- 1M de contexto
- GDPval 83%
- 2026feb
- Especializado en programación
- Terminal-Bench 77.3%
- 2025dicSalto mayor
GPT-5.2
- Output price aún más bajo ($5)
- Mejor eficiencia de razonamiento
- 2025octSalto mayor
GPT-5.1
- Bajan precios output drásticamente ($20 → $8)
- 2025agoSalto mayor
GPT-5.0
- Inicia la serie 5.x con 'sistema unificado'
- 256K context, multimodal nativo
- GPQA Diamond > 70% por primera vez
Aprobación de la comunidad
Pendiente de medir
Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.
¿Encaja contigo?
Si GPT-5.5 te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.
Ver alternativas
En desarrolloEncuentra opciones mejores si priorizas precio, local o creatividad.
Guardar en favoritos
En desarrolloDéjalo marcado para volver cuando tengas claro el caso de uso.