Saltar al contenido principal

Grok 3

por SpaceXAI

La generación que introdujo el razonamiento a escala en Grok y preparó la transición hacia agentes con herramientas.

CerradoResponde con textoEntiende imágenes
Busca en la web
Raziel Score
0.0/10
API
Precio no publicado
Comunidad
Sin datos aún

¿Para qué sí? ¿Para qué no?

Mejor para

  • Razonamiento complejo
    Descomponer problemas ambiguos o multietapa que exigen deliberación.
  • Matemáticas y ciencia
    Resolver problemas cuantitativos, científicos o lógicos exigentes.
  • Ingeniería de software
    Diseñar, implementar y revisar software de producción.
  • Información actual
    Trabajar con búsqueda web o fuentes recientes y cambiantes.

Evitar para

  • Ejecución local
    Ejecutar el modelo en hardware propio sin depender de una API cerrada.

Valoración por categoría

Agentes

Resolución autónoma multi-step

Pendiente · evidencia en revisión
Código

Resolución de bugs y tareas de programación

Pendiente · evidencia en revisión
Razonamiento

Problemas complejos, lógica y conocimiento experto

8.0/10
Trabajo profesional

Documentos, análisis y entregables de trabajo real

Pendiente · evidencia en revisión
Ciencia

Investigación y tareas científicas especializadas

Pendiente · evidencia en revisión
Escritura

Matiz, estilo y creatividad

Pendiente · evidencia en revisión
Imagen

Comprensión, generación o edición visual

Pendiente · evidencia en revisión

Benchmarks traducidos

Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.

Razonamiento

MMLU-Pro

0.0%/100

Resultado alto, cerca de los mejores

Conocimiento y razonamiento académico de mayor dificultad que MMLU.

GPQA Diamond

0.0%/100

Resultado alto, cerca de los mejores

Preguntas científicas de nivel experto con razonamiento exigente.

AA Intelligence Index

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Índice compuesto independiente de Artificial Analysis; solo comparable dentro de la misma versión.

¿Dónde se puede ejecutar?

Viabilidad local
-/10

Modelo cerrado: disponible mediante web o API, sin ejecución local publicada.

Resumen práctico de las formas razonables de usar este modelo.

API / nube
Sin instalación local

Lo usas desde una web, app o API. No instalas el modelo en tu equipo.

Disponible
Servidor potente
No viable

Para correrlo completo necesitas GPU profesional o una máquina grande.

No viable
PC con GPU
No viable

Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.

No viable
Portátil
No viable

Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.

No viable
Móvil / tablet
No viable

Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.

No viable
Más detallesAbrir

Ficha técnica

EmpresaSpaceXAI
PaísEstados Unidos
Lanzamiento19 de febrero de 2025
TipoCerrado
Salida principalTexto
Puede recibirTexto · Imagen
Puede generarTexto

Acceso y apps

Dónde puedes usarlo sin entrar en detalles de hardware.

WebDisponible
MóvilDisponible
EscritorioNo aplica
APIDisponible
PesosNo aplica
Arquitectura

No publicada

Arquitectura no publicada

Arquitectura propietaria; el proveedor no publica pesos ni número de parámetros.

Por qué importa

La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.

Licencia

Proprietary

x.ai/legal/terms-of-service (Ver licencia original)
Uso comercialSin modificacionesSin atribución

Notas
API only. No weights available.

Fuentes

Revisado: 2026-07-13

Historia del modelo

Este modelo tiene versiones más recientes. Aparecen primero para que puedas abrir su ficha.

  1. 2026
    jul
    Salto mayorVersión más reciente

    Grok 4.5

    Abrir ficha de esta versión
    • Foco en coding, agentes y trabajo técnico
    • 80 tokens por segundo y precio $2/$6 por 1M
  2. 2025
    nov
  3. 2025
    jul
    Salto mayorVersión más reciente

    Grok 4

    Abrir ficha de esta versión
    • Uso nativo de herramientas y búsqueda en tiempo real
    • Comprensión multimodal con 256K de contexto
  4. 2025
    feb
    Salto mayorEste modelo

    Grok 3

    • Escala el razonamiento con reinforcement learning
    • Refuerza matemáticas, ciencia y coding

Aprobación de la comunidad

Pendiente de medir

Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.

¿Encaja contigo?

Si Grok 3 te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.

Ver alternativas

En desarrollo

Encuentra opciones mejores si priorizas precio, local o creatividad.

Guardar en favoritos

En desarrollo

Déjalo marcado para volver cuando tengas claro el caso de uso.