Z.ai · 357B (32B active) · Mezcla de expertos
Large GLM MoE with strong coding and 200K context Comprueba si tu GPU o Mac puede ejecutar GLM-4.6 localmente — 199.5 GB mínimo, 332.5 GB recomendado.
2025-09195K contexto
Mezcla de expertos
Expertos totales: 160
Expertos activos: 8
Parámetros activos: 32.0B
| Cuant | Bits | VRAM | Calidad | Estado |
|---|---|---|---|---|
| Q2_K | 2 | 114.8 GB | low | — |
| Q3_K_M | 3 | 160.5 GB | moderate | — |
| Q4_K_M | 4 | 183.4 GB | good | — |
| Q5_K_M | 5 | 229.1 GB | good | — |
| Q6_K | 6 | 274.8 GB | excellent | — |
| Q8_0 | 8 | 366.2 GB | excellent | — |
| F16 | 16 | 732 GB | lossless | — |
¿Puedo ejecutar GLM-4.6 localmente?
- ¿Puedo ejecutar GLM-4.6 localmente?
- GLM-4.6 necesita alrededor de 199.5 GB de memoria como mínimo y 332.5 GB recomendados. Abre esta página para evaluarlo con tu GPU o Mac, y luego ejecútalo con runai, Ollama o LM Studio.
- ¿Cuánta VRAM necesita GLM-4.6?
- En Q4_K_M, GLM-4.6 usa aproximadamente 183.4 GB de VRAM. Cuantizaciones más altas necesitan más memoria; las más bajas caben en tarjetas más ajustadas con una pérdida de calidad.