Das Qwen-Team hat Qwen3-Coder angekündigt und mit Qwen3-Coder-480B-A35B-Instruct zunächst seine nach eigener Darstellung leistungsstärkste Variante vorgestellt. Gleichzeitig veröffentlicht das Team Qwen Code als Open-Source-Kommandozeilenwerkzeug für agentisches Programmieren.

Quellenlage
PrimärquelleQwen Blog
Bestätigt durch1 unabhängiger Ursprung · 1 Quellen insgesamt
OffenWelche weiteren Qwen3-Coder-Größen erscheinen werden und wann sie verfügbar sein sollen.

Modell mit 35 Milliarden aktiven Parametern

Qwen beschreibt Qwen3-Coder-480B-A35B-Instruct als Mixture-of-Experts-Modell mit insgesamt 480 Milliarden Parametern, von denen 35 Milliarden aktiv sind. Das Modell unterstütze nativ einen Kontext von 256.000 Tokens; durch Extrapolationsmethoden seien bis zu einer Million Tokens möglich.

Qwen3-Coder soll in mehreren Größen erscheinen. Weitere Varianten seien geplant, teilte das Team mit. Konkrete Modellgrößen, Termine oder Angaben zu den erwarteten Bereitstellungskosten nennt das vorliegende Material nicht.

Qwen Code ist ein Forschungswerkzeug für die Kommandozeile

Mit Qwen Code veröffentlicht das Team nach eigenen Angaben ein Kommandozeilenwerkzeug für agentisches Coding als Open Source. Es wird als Werkzeug für Forschungszwecke beschrieben, das von Gemini CLI adaptiert wurde und einen erweiterten Parser sowie Werkzeugunterstützung für Qwen-Coder-Modelle bietet.

Laut Qwen wurde das Tool mit angepassten Prompts und Function-Calling-Protokollen versehen. Das Unternehmen erklärt zudem, Qwen3-Coder könne über einen API-Schlüssel der Alibaba-Cloud-Model-Studio-Plattform mit Claude Code verwendet werden.

Leistungsangaben stammen vom Anbieter

Qwen beansprucht für Qwen3-Coder-480B-A35B-Instruct neue Bestwerte unter offenen Modellen bei Agentic Coding, Agentic Browser-Use und Agentic Tool-Use. Das Team bezeichnet die Leistung außerdem als vergleichbar mit Claude Sonnet 4.

Diese Einordnungen sind Herstellerangaben aus dem Ankündigungsbeitrag. Im vorliegenden Dossier gibt es keine unabhängige Quelle, die die Benchmark-Ergebnisse, die Vergleichbarkeit mit Claude Sonnet 4 oder die Bedingungen der Tests überprüft.

Training und Bedeutung für Entwickler

Für das Training berichtet Qwen von einer skalierbaren Umgebung mit 20.000 parallel laufenden, unabhängigen Umgebungen auf Infrastruktur von Alibaba Cloud. Diese Angabe illustriert den Umfang der vom Team beschriebenen Trainings- und Evaluierungsumgebung, ist aber ebenfalls nicht unabhängig bestätigt.

Die Ankündigung verbindet ein großes Coding-Modell mit einem offenen CLI-Werkzeug und einer behaupteten Anbindung an bestehende Entwicklerwerkzeuge. Für Entwickler dürfte die praktische Relevanz davon abhängen, wie sich Modellzugang, Tool-Integration, Leistung und Betriebskosten außerhalb der Herstellerdarstellung bewähren.

Wie es weitergeht

Entscheidend werden unabhängige Tests der Leistungsbehauptungen sowie Details zu den weiteren Modellvarianten, Zugangswegen und Einsatzbedingungen sein.

Änderungsvermerk: Erstfassung auf Basis einer einzelnen Primärquelle, dem Qwen-Blogbeitrag vom 22. Juli 2025.