Saltar al contenido principal

Claude Opus 4.8

por Anthropic
Destacado

El flagship actual de Anthropic (junio 2026). Refuerzo sobre 4.7 en coding, agentic tasks y razonamiento sostenido en sesiones largas.

CerradoResponde con textoEntiende imágenes
Busca en la webEjecuta códigoUsa el ordenador
Raziel Score
0.0/10
API
$5.00 / $25.00por millón de tokens
Ventana de contexto
1M tokens
Comunidad
Sin datos aún

¿Para qué sí? ¿Para qué no?

Mejor para

  • Razonamiento complejo
    Descomponer problemas ambiguos o multietapa que exigen deliberación.
  • Programación agéntica
    Resolver issues y modificar repositorios con autonomía y herramientas.
  • Agentes de larga duración
    Mantener objetivos y contexto durante sesiones prolongadas o proyectos complejos.
  • Análisis profesional
    Producir análisis rigurosos para trabajo técnico o de negocio.

Evitar para

  • Presupuesto ajustado
    Priorizar coste total bajo frente al máximo rendimiento absoluto.
  • Procesamiento de alto volumen
    Procesar muchas solicitudes con coste y rendimiento previsibles.
  • Automatización simple
    Clasificar, extraer, enrutar o formatear tareas repetitivas.

Valoración por categoría

Agentes

Resolución autónoma multi-step

9.0/10
Código

Resolución de bugs y tareas de programación

8.5/10
Razonamiento

Problemas complejos, lógica y conocimiento experto

8.5/10
Trabajo profesional

Documentos, análisis y entregables de trabajo real

8.5/10
Ciencia

Investigación y tareas científicas especializadas

6.5/10
Escritura

Matiz, estilo y creatividad

Pendiente · evidencia en revisión
Imagen

Comprensión, generación o edición visual

Pendiente · evidencia en revisión
Precio

Coste por millón de tokens

5.5/10

Benchmarks traducidos

Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.

Programación

Terminal-Bench 2.1

0.0%/100

Resultado alto, cerca de los mejores

Fuerte en tareas de terminal y tooling multi-paso.

SWE-Bench Pro

0.0%/100

Resultado alto, cerca de los mejores

Muy alto en coding agéntico: resuelve issues complejos de repos reales.

DeepSWE 1.1

0.0%/100

Resultado alto, cerca de los mejores

Ingeniería de software de horizonte largo con un harness agéntico concreto; solo es comparable si coinciden versión y harness.

Trabajo profesional

GDPval-AA v2

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Calidad de entregables profesionales evaluada mediante comparaciones ciegas.

GDPval AA

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Score alto en evaluación de tareas profesionales, útil para comparar dentro de GDPval.

Agentes y herramientas

OSWorld 2.0

0.0%/100

Buen resultado, sin destacar en esta prueba

Uso autónomo de interfaces de ordenador bajo la versión 2.0.

BrowseComp

0.0%/100

Resultado de primera línea en esta prueba

Búsqueda web multi-paso para encontrar información difícil.

MCP Atlas

0.0%/100

Resultado alto, cerca de los mejores

Uso de herramientas y coordinación mediante MCP o entornos instrumentados.

Razonamiento

AA Intelligence Index

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Índice compuesto independiente de Artificial Analysis; solo comparable dentro de la misma versión.

Ciencia y salud

GeneBench Pro

0.0%/100

Resultado bajo para una prueba exigente

Análisis cuantitativo y flujos de investigación genómica.

LifeSciBench

0.0%/100

Buen resultado, sin destacar en esta prueba

Tareas realistas de investigación en ciencias de la vida.

HealthBench Professional

0.0%/100

Buen resultado, sin destacar en esta prueba

Rendimiento en consultas profesionales de salud.

¿Dónde se puede ejecutar?

Viabilidad local
-/10

Modelo cerrado: disponible mediante web o API, sin ejecución local publicada.

Resumen práctico de las formas razonables de usar este modelo.

API / nube
Sin instalación local

Lo usas desde una web, app o API. No instalas el modelo en tu equipo.

Disponible
Servidor potente
No viable

Para correrlo completo necesitas GPU profesional o una máquina grande.

No viable
PC con GPU
No viable

Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.

No viable
Portátil
No viable

Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.

No viable
Móvil / tablet
No viable

Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.

No viable
Más detallesAbrir

Ficha técnica

EmpresaAnthropic
PaísEstados Unidos
Lanzamientojunio de 2026
TipoCerrado
Salida principalTexto
Puede recibirTexto · Imagen
Puede generarTexto
Ventana de contexto1M tokens
Tokens de salida128K tokens
Suscripción mínima$20/mes

Acceso y apps

Dónde puedes usarlo sin entrar en detalles de hardware.

WebDisponible
MóvilDisponible
EscritorioDisponible
APIDisponible
PesosNo aplica
Arquitectura

No publicada

Arquitectura no publicada

El proveedor no publica la arquitectura de este modelo.

Por qué importa

La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.

Licencia

Proprietary

www.anthropic.com/legal/commercial-terms (Ver licencia original)
Uso comercialSin modificacionesSin atribución

Notas
API only. No weights available. Anthropic no publica arquitectura.

Fuentes

Revisado: 2026-07-13

Historia del modelo

La versión actual y el linaje que explica de dónde viene y qué cambió por el camino.

  1. 2026
    jun
    Salto mayorEste modelo

    Claude Opus 4.8

    • Flagship actual de Anthropic
    • Hasta 300k output tokens en Message Batches API (beta)
  2. 2026
    may
  3. 2026
    abr
  4. 2025
    nov
    Salto mayor

    Claude Opus 4.5

    • Salto en programación y razonamiento profundo
  5. 2024
    mar
    Salto mayor

    Claude 3 Opus

    • Estrena el tier Opus para las tareas más exigentes

Aprobación de la comunidad

Pendiente de medir

Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.

¿Encaja contigo?

Si Claude Opus 4.8 te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.

Ver alternativas

En desarrollo

Encuentra opciones mejores si priorizas precio, local o creatividad.

Guardar en favoritos

En desarrollo

Déjalo marcado para volver cuando tengas claro el caso de uso.