Z.ai · 753B (40B active) · Mezcla de expertos
Same 753B / 40B-active base as GLM-5.2 — post-training lifts coding and long-horizon agents, 1M context Comprueba si tu GPU o Mac puede ejecutar GLM-5.3 localmente — 420.8 GB mínimo, 701.3 GB recomendado.
2026-081024K contexto
Mezcla de expertos
Expertos totales: 256
Expertos activos: 8
Parámetros activos: 40.0B
| Cuant | Bits | VRAM | Calidad | Estado |
|---|---|---|---|---|
| Q2_K | 2 | 241.6 GB | low | — |
| Q3_K_M | 3 | 338 GB | moderate | — |
| Q4_K_M | 4 | 386.2 GB | good | — |
| Q5_K_M | 5 | 482.6 GB | good | — |
| Q6_K | 6 | 579.1 GB | excellent | — |
| Q8_0 | 8 | 771.9 GB | excellent | — |
| F16 | 16 | 1543.3 GB | lossless | — |
¿Puedo ejecutar GLM-5.3 localmente?
- ¿Puedo ejecutar GLM-5.3 localmente?
- GLM-5.3 necesita alrededor de 420.8 GB de memoria como mínimo y 701.3 GB recomendados. Abre esta página para evaluarlo con tu GPU o Mac, y luego ejecútalo con runai, Ollama o LM Studio.
- ¿Cuánta VRAM necesita GLM-5.3?
- En Q4_K_M, GLM-5.3 usa aproximadamente 386.2 GB de VRAM. Cuantizaciones más altas necesitan más memoria; las más bajas caben en tarjetas más ajustadas con una pérdida de calidad.