Mistral Nemo 12B

Apache 2.0

Mistral AI · 12B · Densa

Multilingual 12B with 128K context Comprueba si tu GPU o Mac puede ejecutar Mistral Nemo 12B localmente — 6.7 GB mínimo, 11.2 GB recomendado.

2024-07128K contexto

Opciones de cuantización

CuantBitsVRAMCalidadEstado
Q2_K24.3 GBlow
Q3_K_M35.9 GBmoderate
Q4_K_M46.6 GBgood
Q5_K_M58.2 GBgood
Q6_K69.7 GBexcellent
Q8_0812.8 GBexcellent
F161625.1 GBlossless

Sobre este modelo

Mistral NeMo is a 12B model built in collaboration with NVIDIA. Mistral NeMo offers a large context window of up to 128k tokens. Its reasoning, world knowledge, and coding accuracy are state-of-the-art in its size category. As it relies on standard architecture, Mistral NeMo is easy to use and a drop-in replacement in any system using Mistral 7B.

nemo-base-performance.png

Reference

Blog

Hugging Face

¿Puedo ejecutar Mistral Nemo 12B localmente?

¿Puedo ejecutar Mistral Nemo 12B localmente?
Mistral Nemo 12B necesita alrededor de 6.7 GB de memoria como mínimo y 11.2 GB recomendados. Abre esta página para evaluarlo con tu GPU o Mac, y luego ejecútalo con runai, Ollama o LM Studio.
¿Cuánta VRAM necesita Mistral Nemo 12B?
En Q4_K_M, Mistral Nemo 12B usa aproximadamente 6.6 GB de VRAM. Cuantizaciones más altas necesitan más memoria; las más bajas caben en tarjetas más ajustadas con una pérdida de calidad.