Saltar al contenido principal

GLM-5

por Zhipu AI

El 'arquitecto de sistemas'. Primer modelo open weight que puede correr autónomamente 24h+ con 700+ tool calls. Aproxima a Claude Opus 4.5 en programación real.

Pesos abiertos · MITResponde con texto
Busca en la web
Raziel Score
0.0/10
API
Precio no publicado
Ventana de contexto
128K tokens
Comunidad
Sin datos aún

¿Para qué sí? ¿Para qué no?

Mejor para

  • Agentes de larga duración
    Mantener objetivos y contexto durante sesiones prolongadas o proyectos complejos.
  • Ingeniería de software
    Diseñar, implementar y revisar software de producción.
  • Agentes con herramientas
    Coordinar APIs, terminal, navegación y otras herramientas en varios pasos.

Evitar para

  • Baja latencia
    Responder rápido en experiencias interactivas o automatizaciones frecuentes.
  • Presupuesto ajustado
    Priorizar coste total bajo frente al máximo rendimiento absoluto.

Valoración por categoría

Agentes

Resolución autónoma multi-step

Pendiente · evidencia en revisión
Código

Resolución de bugs y tareas de programación

Preliminar5.0/10
Razonamiento

Problemas complejos, lógica y conocimiento experto

7.5/10
Trabajo profesional

Documentos, análisis y entregables de trabajo real

Pendiente · evidencia en revisión
Ciencia

Investigación y tareas científicas especializadas

Pendiente · evidencia en revisión
Escritura

Matiz, estilo y creatividad

Pendiente · evidencia en revisión

Benchmarks traducidos

Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.

Programación

SWE-Bench Verified

0.0%/100

Resultado alto, cerca de los mejores

Issues reales de GitHub sobre el subconjunto verificado; no debe mezclarse con SWE-Bench Pro.

Razonamiento

AA Intelligence Index

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Índice compuesto independiente de Artificial Analysis; solo comparable dentro de la misma versión.

¿Dónde se puede ejecutar?

Viabilidad local
5.0/10

Posible, pero con límites claros de hardware, coste o calidad.

Resumen práctico de las formas razonables de usar este modelo.

API / nube
No viable

Lo usas desde una web, app o API. No instalas el modelo en tu equipo.

No viable
Servidor potente
150 GB+ VRAM

Para correrlo completo necesitas GPU profesional o una máquina grande.

Recomendado
PC con GPU
No viable

Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.

No viable
Portátil
No viable

Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.

No viable
Móvil / tablet
No viable

Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.

No viable
Más detallesAbrir
Memoria mínima para calidad completa150 GB (FP16)
Equipo idealServidor multi-GPU

Ficha técnica

EmpresaZhipu AI
PaísChina
Lanzamiento11 de febrero de 2026
TipoPermisivo
Salida principalTexto
Puede recibirTexto
Puede generarTexto
Ventana de contexto128K tokens
Tokens de salida32K tokens

Acceso y apps

Dónde puedes usarlo sin entrar en detalles de hardware.

WebDisponible
MóvilNo aplica
EscritorioNo aplica
APIDisponiblePesosDisponible
Arquitectura

Mixture of Experts

Arquitectura publicada

MoE 744B total / 40B activos con DeepSeek Sparse Attention (DSA).

Por qué importa

La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.

Licencia

MIT

github.com/THUDM/GLM-4/blob/main/MODEL_LICENSE (Ver licencia original)
Uso comercialModificaciones permitidasAtribución requerida

Fuentes

Revisado: 2026-07-13

Historia del modelo

Este modelo tiene versiones más recientes. Aparecen primero para que puedas abrir su ficha.

  1. 2026
    jun
    Salto mayorVersión más reciente

    GLM-5.2

    • 1M de contexto usable
    • Open weights MIT
    • Sin benchmarks oficiales al lanzamiento (controvertido)
  2. 2026
    abr
    Salto mayorVersión más reciente

    GLM-5.1

    • Post-training upgrade de GLM-5
    • Top en SWE-Bench Pro entre open weights
  3. 2026
    feb
    Salto mayorEste modelo

    GLM-5

    • 744B / 40B activos MoE
    • DeepSeek sparse attention integrada
    • Corre 24h+ autonomo, 700+ tool calls
    • Aproxima Opus 4.5 en programación
  4. 2026
    ene
    Salto mayor

    GLM-4.7 Flash

    • 30B / 3B activos
    • Open source MIT
    • Gratis en BigModel.cn
  5. 2025
    jul
    Salto mayor

    GLM-4.5

    • 355B params / 32B activos MoE
    • SWE-bench Verified 64.2%
    • Primer GLM con arquitectura agent
  6. 2025
    jul
    Salto mayor

    GLM-4.5-Air

    • 106B params / 12B activos
    • Variante ligera del 4.5

Aprobación de la comunidad

Pendiente de medir

Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.

¿Encaja contigo?

Si GLM-5 te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.

Ver alternativas

En desarrollo

Encuentra opciones mejores si priorizas precio, local o creatividad.

Guardar en favoritos

En desarrollo

Déjalo marcado para volver cuando tengas claro el caso de uso.