Qwen3-Coder-30B-A3B-Instruct – inoffiziell „Qwen3-Coder-Flash“ – bringt das agentische Coding-Können der großen 480B-Variante in ein kompaktes, lokal betreibbares Modell. Mit 30,5 Milliarden Parametern und nur 3,3 Milliarden aktiven eignet es sich für schnelle Coding-Agenten in IDE, CLI und CI – auf einer einzelnen High-End-GPU.
Qwen3-Coder-30B-A3B-Instruct („Flash“)
Alibaba (Qwen-Team)
Juli 2025
Apache 2.0
MoE, Coder / agentic Instruct
30,5 Mrd. total (3,3 Mrd. aktiv)
48 Layer, 128 Experten (8 aktiv), agentic Function-Call-Format
262.144 nativ, bis ≈ 1 Mio.
Für viele Teams ist Flash der beste Kompromiss aus Coding-Qualität und Betriebskosten. Wir beraten Sie gern.
Flash übernimmt das agentische Function-Call-Format der großen Coder-Variante, bleibt durch die niedrige Aktivierung aber ressourcenschonend.
Damit lassen sich Coding-Agenten kostengünstig und lokal betreiben – ein pragmatischer Einstieg in werkzeuggestützte Entwicklung.
Für kostengünstige, lokale Coding-Unterstützung.
Lokal hostbar
Agentisch einsetzbar
Viele Quantisierungsformate
Offen unter Apache 2.0
Schwächer als der 480B-Coder
MoE-RAM-Bedarf über aktiven Parametern
Wenige offizielle Benchmarkzahlen
Wir bringen Qwen3-Coder-Flash auf Ihre Hardware – als schnellen, lokalen Coding-Assistenten für Ihr Team.