Saltar al contenido principal

GPT-5.3 Codex

por OpenAI

Versión especializada en programación de GPT-5. Más rápido y barato que el flagship, ideal para tareas de programación dedicadas.

CerradoResponde con texto
Ejecuta código
Raziel Score
0.0/10
API
$1.75 / $14.00por millón de tokens
Ventana de contexto
400K tokens
Comunidad
Sin datos aún

¿Para qué sí? ¿Para qué no?

Mejor para

  • Ingeniería de software
    Diseñar, implementar y revisar software de producción.
  • Asistencia de código
    Autocompletar, explicar y programar en pareja con baja fricción.
  • Programación agéntica
    Resolver issues y modificar repositorios con autonomía y herramientas.

Evitar para

  • Escritura creativa
    Crear narrativa, estilo, voz y textos largos con matiz.
  • Análisis profesional
    Producir análisis rigurosos para trabajo técnico o de negocio.

Valoración por categoría

Agentes

Resolución autónoma multi-step

Preliminar4.5/10
Código

Resolución de bugs y tareas de programación

Preliminar5.0/10
Razonamiento

Problemas complejos, lógica y conocimiento experto

8.0/10
Trabajo profesional

Documentos, análisis y entregables de trabajo real

Preliminar5.5/10
Ciencia

Investigación y tareas científicas especializadas

Pendiente · evidencia en revisión
Escritura

Matiz, estilo y creatividad

Pendiente · evidencia en revisión
Precio

Coste por millón de tokens

6.5/10

Benchmarks traducidos

Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.

Programación

SWE-Bench Pro

0.0%/100

Resultado alto, cerca de los mejores

Resolución end-to-end de issues reales de GitHub. Mide capacidad agéntica en código.

Terminal-Bench 2.0

0.0%/100

Resultado alto, cerca de los mejores

Mide tareas complejas de terminal con la versión 2.0; el harness debe coincidir para comparar.

Capture-the-Flag Challenges

0.0%/100

Resultado alto, cerca de los mejores

Resolución técnica de retos de ciberseguridad autorizados.

Trabajo profesional

GDPval-AA v2

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Calidad de entregables profesionales evaluada mediante comparaciones ciegas.

SWE-Lancer IC Diamond

0.0%/100

Resultado de primera línea en esta prueba

Tareas profesionales de ingenieria de software con compensacion economica.

Agentes y herramientas

OSWorld 2.0

0.0%/100

Resultado alto, cerca de los mejores

Uso autónomo de interfaces de ordenador bajo la versión 2.0.

Razonamiento

AA Intelligence Index

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Índice compuesto independiente de Artificial Analysis; solo comparable dentro de la misma versión.

¿Dónde se puede ejecutar?

Viabilidad local
-/10

Modelo cerrado: disponible mediante web o API, sin ejecución local publicada.

Resumen práctico de las formas razonables de usar este modelo.

API / nube
Sin instalación local

Lo usas desde una web, app o API. No instalas el modelo en tu equipo.

Disponible
Servidor potente
No viable

Para correrlo completo necesitas GPU profesional o una máquina grande.

No viable
PC con GPU
No viable

Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.

No viable
Portátil
No viable

Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.

No viable
Móvil / tablet
No viable

Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.

No viable

Ficha técnica

EmpresaOpenAI
PaísEstados Unidos
Lanzamientofebrero de 2026
TipoCerrado
Salida principalTexto
Puede recibirTexto
Puede generarTexto
Ventana de contexto400K tokens
Tokens de salida32K tokens

Acceso y apps

Dónde puedes usarlo sin entrar en detalles de hardware.

WebDisponible
MóvilNo aplica
EscritorioNo aplica
APIDisponible
PesosNo aplica
Arquitectura

No publicada

Arquitectura no publicada

El proveedor no publica la arquitectura de este modelo.

Por qué importa

La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.

Licencia

Proprietary

openai.com/policies (Ver licencia original)
Uso comercialSin modificacionesSin atribución

Notas
API only. No weights available.

Fuentes

Revisado: 2026-07-13

Historia del modelo

Este modelo tiene versiones más recientes. Aparecen primero para que puedas abrir su ficha.

  1. 2026
    jul
    Salto mayorVersión más reciente

    GPT-5.6 Sol

    Abrir ficha de esta versión
    • Nuevo flagship y mayor capacidad bajo demanda
    • Programmatic Tool Calling y niveles de effort configurables
  2. 2026
    jul
    Salto mayorVersión más reciente

    GPT-5.6 Terra

    Abrir ficha de esta versión
    • Tier equilibrado con rendimiento competitivo frente a GPT-5.5
    • Programmatic Tool Calling y niveles de effort configurables
  3. 2026
    jul
    Salto mayorVersión más reciente

    GPT-5.6 Luna

    Abrir ficha de esta versión
    • Tier más rápido y asequible
    • Programmatic Tool Calling y niveles de effort configurables
  4. 2026
    abr
    Salto mayorVersión más reciente

    GPT-5.5

    Abrir ficha de esta versión
    • Persistente en tareas multi-step
    • Mejor en programación y uso de herramientas
    • Terminal-Bench 82.7%
  5. 2026
    mar
  6. 2026
    feb
    Salto mayorEste modelo

    GPT-5.3 Codex

    • Especializado en programación
    • Terminal-Bench 77.3%
  7. 2025
    dic
    Salto mayor

    GPT-5.2

    • Output price aún más bajo ($5)
    • Mejor eficiencia de razonamiento
  8. 2025
    oct
    Salto mayor

    GPT-5.1

    • Bajan precios output drásticamente ($20 → $8)
  9. 2025
    ago
    Salto mayor

    GPT-5.0

    • Inicia la serie 5.x con 'sistema unificado'
    • 256K context, multimodal nativo
    • GPQA Diamond > 70% por primera vez

Aprobación de la comunidad

Pendiente de medir

Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.

¿Encaja contigo?

Si GPT-5.3 Codex te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.

Ver alternativas

En desarrollo

Encuentra opciones mejores si priorizas precio, local o creatividad.

Guardar en favoritos

En desarrollo

Déjalo marcado para volver cuando tengas claro el caso de uso.