Qwen 3 Coder 480B

Apache 2.0

Alibaba · 480B (35B active) · Mezcla de expertos

Largest open coding MoE — 35B active Comprueba si tu GPU o Mac puede ejecutar Qwen 3 Coder 480B localmente — 268.2 GB mínimo, 447 GB recomendado.

2025-07256K contexto

Mezcla de expertos

Expertos totales: 128
Expertos activos: 8
Parámetros activos: 35.0B

Opciones de cuantización

CuantBitsVRAMCalidadEstado
Q2_K2154.2 GBlow
Q3_K_M3215.6 GBmoderate
Q4_K_M4246.4 GBgood
Q5_K_M5307.8 GBgood
Q6_K6369.3 GBexcellent
Q8_08492.2 GBexcellent
F1616984 GBlossless

Sobre este modelo

Qwen 3 logo Qwen3-Coder is the most agentic code model to date in the Qwen series.

Get started

480B

Cloud

ollama run qwen3-coder:480b-cloud

Local

ollama run qwen3-coder:480b

Running locally requires a minimum of 250GB of memory or unified memory.

30B

ollama run qwen3-coder:30b

Overview

qwen3-coder:30b offers 30B total parameters with only 3.3B activated, delivering strong performance while maintaining efficiency.

  • Exceptional agentic capabilities for real-world software engineering tasks through advanced long-horizon reinforcement learning on SWE-Bench and similar benchmarks.
  • Long context support with 256K tokens natively and up to 1M tokens using extrapolation methods, optimized for repository-scale understanding.
  • Scaled pretraining on 7.5T tokens (70% code ratio) while preserving strong general and mathematical abilities.
  • Execution-driven reinforcement learning that significantly boosts code execution success rates across diverse real-world coding tasks.

image.png

Reference

¿Puedo ejecutar Qwen 3 Coder 480B localmente?

¿Puedo ejecutar Qwen 3 Coder 480B localmente?
Qwen 3 Coder 480B necesita alrededor de 268.2 GB de memoria como mínimo y 447 GB recomendados. Abre esta página para evaluarlo con tu GPU o Mac, y luego ejecútalo con runai, Ollama o LM Studio.
¿Cuánta VRAM necesita Qwen 3 Coder 480B?
En Q4_K_M, Qwen 3 Coder 480B usa aproximadamente 246.4 GB de VRAM. Cuantizaciones más altas necesitan más memoria; las más bajas caben en tarjetas más ajustadas con una pérdida de calidad.