73 modelos en Q4 · presupuesto de 24 GB

Modelos de IA local para 24GB de VRAM

24 GB es el punto óptimo para entusiastas. Caben los modelos densos de 30B, las mezclas de expertos de tamaño medio se vuelven utilizables, y la generación local de imagen o vídeo corto es realista.

Encaje típico: Modelos densos de 30B, MoE de tamaño medio, o vídeo local. · Ejemplo:RTX 4090

Estos tamaños asumen Q4_K_M más un pequeño overhead de runtime.Califica el catálogo completo en tu máquinaoelige una GPU concreta.

Preguntas frecuentes

¿Qué modelos puede ejecutar en local una RTX 4090?
Casi todos los modelos abiertos populares de chat y código con alta calidad, además de generación de imagen de la clase FLUX y los checkpoints de vídeo más ligeros.