Qwen3.8-Max erscheint mit offenen Gewichten: Was Entwickler jetzt bauen

Alibaba veröffentlichte Qwen3.8-Max am August 3, 2026 – erstmals mit offenen Gewichten für ein Qwen-Modell der Max-Klasse. Die lokal ausführbare Version mit 27B Parametern folgt nächste Woche. Der Leitfaden zeigt Änderungen, Benchmarks und den schnellen Weg zu einem echten Produkt.

Häufige Fragen

Ist Qwen3.8-Max mit offenen Gewichten verfügbar?

Ja. Qwen3.8-Max wurde am August 3, 2026 als erstes Qwen-Modell der Max-Klasse mit offenen Gewichten veröffentlicht. Sie können es über Anbieter wie OpenRouter, Together AI oder die offizielle Qwen-API ausführen. Eine lokal ausführbare Open-Weights-Variante Qwen3.8-27B ist ebenfalls für die folgende Woche geplant und lässt sich voraussichtlich auf einer leistungsstarken Consumer-GPU betreiben.

Wie schneidet Qwen3.8-Max beim Programmieren im Vergleich zu Claude oder GPT ab?

Alibaba positioniert Qwen3.8-Max als leistungsfähiges Modell für Programmierung und Zusammenarbeit und behauptet, damit in dieser Kategorie neue Maßstäbe zu setzen. In der Praxis liegt Claude Opus 5 (veröffentlicht am Juli 24, 2026) bei komplexer Codeerstellung über mehrere Dateien und Architekturüberlegungen weiterhin vorn. Qwen3.8-Max ist bei Aufgaben mit einer Datei konkurrenzfähig, unterstützt mehrsprachiges Programmieren gut und lässt sich wegen seiner offenen Gewichte selbst hosten oder feinabstimmen – anders als geschlossene Modelle.

Wie baue ich mit Qwen3.8-Max eine App, ohne die Infrastruktur selbst zu verwalten?

Nutzen Sie die Qwen-API oder OpenRouter (Qwen3.8-Max war dort vom ersten Tag an verfügbar) als Modellendpunkt und erstellen Sie die Produktebene mit einem KI-Baukasten. Mit We.Inc beschreiben Sie die App in einfacher Sprache und erhalten sofort eine funktionierende React-App. Hinterlegen Sie Ihren Qwen-API-Schlüssel für den Modellaufruf und veröffentlichen Sie die App unter einer eigenen Domain. Der erzeugte Code gehört Ihnen und lässt sich exportieren. So erhalten Sie dieselbe Unabhängigkeit, die offene Gewichte attraktiv macht. Kostenlos starten unter we.inc.

Kann ich Qwen3.8-Max lokal ausführen?

Qwen3.8-Max selbst ist ein großes Modell und nicht für lokale Nutzung durch Privatpersonen ausgelegt. Alibaba hat jedoch Qwen3.8-27B als separates Modell mit offenen Gewichten angekündigt, geplant für die Woche ab dem August 10, 2026. Die 27B-Variante läuft auf einer leistungsstarken GPU; eine RTX 4090 mit 24 GB VRAM reicht für quantisierte Inferenz aus. Sie bietet für Programmieraufgaben viele Fähigkeiten des Max-Modells. Bis dahin sind Qwen-API und OpenRouter der schnellste Einstieg.

Alibaba veröffentlichte Qwen3.8-Max am August 3, 2026. Innerhalb weniger Stunden stand das Modell mit fast 1.000 Punkten auf der Titelseite von Hacker News. Die Meldung ist mehr als ein weiterer Modellstart: Erstmals veröffentlicht Alibaba ein Modell der Max-Klasse – seiner Spitzenkategorie – mit offenen Gewichten. OpenRouter bot es bereits am ersten Tag an. Die lokal ausführbare Version Qwen3.8-27B folgt nächste Woche.

Kurzfassung: Qwen3.8-Max ist derzeit das leistungsfähigste Coding-Modell mit offenen Gewichten, das über eine API verfügbar ist. Wenn Sie heute ein Produkt darauf aufbauen möchten, bringen Sie Qwen-API oder OpenRouter in wenigen Minuten zum Laufen. Mit We.Inc erstellen Sie ohne eigene Infrastruktur eine vollständige funktionierende App um diesen Endpunkt. Die lokal ausführbare 27B-Version erscheint nächste Woche und soll auf einer GPU mit 24 GB laufen.

Was sich bei Qwen3.8 geändert hat

Die Qwen-Reihe war für ihre jeweilige Größenklasse schon immer leistungsfähig. Qwen 3.6-27B galt als eines der besten lokalen Modelle für Programmierung, Schlussfolgern und mehrsprachige Aufgaben. In dieser Größe kam kaum ein Modell heran. Mit Qwen3.8 erfolgt der Sprung in die Max-Klasse. Wichtig sind vor allem diese Punkte:

Offene Gewichte auf Spitzenmodellniveau. Frühere Qwen-Max-Versionen waren nur über eine geschlossene API verfügbar. Die Veröffentlichung von Gewichten mit dieser Leistungsfähigkeit ist die eigentliche Nachricht, nicht ein Benchmarkwert. Sie können das Modell selbst hosten, feinabstimmen oder hinter der eigenen Firewall betreiben, ohne von der Verfügbarkeit der Alibaba-API abhängig zu sein.

Programmierung und „Cowork“ sind die genannten Haupteinsatzgebiete. Im offiziellen Blog wird Qwen3.8-Max als Modell für Softwareentwicklungsabläufe beschrieben, bei denen Entwickler und KI während einer längeren Sitzung fortlaufend Kontext austauschen. Es geht nicht um einmalige Autovervollständigung, sondern um gemeinsame Entwicklungsarbeit. Die mit dem Modell veröffentlichten Benchmarks zeigen bei HumanEval, MBPP und mehrstufigen Programmierszenarien Ergebnisse auf oder über dem Niveau früherer Qwen-Max-Versionen.

Lokale Variante mit 27B Parametern für nächste Woche bestätigt. Im HN-Thread wurde eine Veröffentlichung von Qwen3.8-27B für die Woche ab dem 10. August angekündigt. Qwen3.6-27B gilt bereits weithin als bestes lokales Modell seiner Größenklasse. Die 27B-Version von 3.8 dürfte das Modell werden, das Entwickler auf ihren eigenen Rechnern ausführen.

OpenRouter ab dem ersten Tag. Das ist praktisch wichtig: Mit einem vorhandenen OpenRouter-Schlüssel können Sie Qwen3.8-Max sofort und ohne Einrichtung eines neuen Anbieters aufrufen.

Wo Qwen3.8-Max in die aktuelle Modelllandschaft passt

Drei Veröffentlichungen prägten in den letzten zwei Wochen die Spitzenklasse: Claude Opus 5 (24. Juli), offene Gewichte für Kimi K3 (Ende Juli, 2,8 Billionen Parameter) und jetzt Qwen3.8-Max (3. August). Jedes Modell bedient andere Anforderungen:

ModellBesonders geeignet fürOffene GewichteLokal ausführbar
Claude Opus 5Komplexe Codeerstellung über mehrere Dateien, ArchitekturNeinNein
Kimi K3Aufgaben mit langem Kontext, ForschungsdokumenteJaNein (2,8 Billionen Parameter)
Qwen3.8-MaxProgrammieren, mehrere Sprachen, lange SitzungenJaJetzt über API, lokale 27B-Version nächste Woche
Qwen3.8-27B (geplant)Lokaler Coding-AssistentJaJa, GPU mit 24 GB

Wenn Sie ein Produkt mit einem Spitzenmodell veröffentlichen und offene Gewichte wichtig finden, ist Qwen3.8-Max derzeit die praktischste Wahl. Kimi K3 bietet ebenfalls offene Gewichte, benötigt mit 2,8 Billionen Parametern aber Rechenzentrum-Hardware. Qwen3.8-27B soll das erste Spitzenmodell werden, das Entwickler tatsächlich auf einer Workstation ausführen können.

Was Entwickler derzeit damit bauen

In den frühen Qwen3.8-Threads zeichnen sich einige konkrete Anwendungen ab:

Programmierassistenten für lange Sitzungen. Die Ausrichtung auf „Cowork“ ist ernst gemeint: Qwen-Modelle kommen gut mit langen Kontexten zurecht und eignen sich daher für Aufgaben, bei denen eine Funktion über Dutzende Dateien hinweg entwickelt wird, statt nur eine einmalige Frage zu beantworten. Kleine Unternehmen, die einen selbst gehosteten internen KI-Programmierpartner möchten, sind die Zielgruppe.

Mehrsprachige SaaS-Tools. Qwen galt in der Vergangenheit als stärkste Modellfamilie für Programmierkontexte außerhalb des Englischen, besonders für ostasiatische Sprachen. Teams, die Tools für japanische, chinesische oder koreanische Märkte entwickeln, setzen es bereits als Ersatz für englischzentrierte Modelle ein.

Intern genutzte, feinabgestimmte Tools. Offene Gewichte ermöglichen Feinabstimmung. Unternehmen, die spezialisierte Coding-Agenten für ihre eigenen Technologiestapel entwickeln – etwa mit proprietären SDKs, internen APIs oder branchenspezifischen Frameworks – können Qwen3.8 auf ihrer Codebasis trainieren. Geschlossene Modelle erlauben das nicht.

Der schnellste Weg zu einer App mit Qwen3.8-Max

Der Modellendpunkt ist der einfache Teil. Projekte stocken meist bei der Entwicklung des Produkts darum herum. So geht es konkret mit We.Inc:

  1. Qwen-API-Schlüssel besorgen unter qwen.ai oder OpenRouter verwenden, wenn Sie dort bereits ein Konto haben. Sie erhalten eine URL und einen Schlüssel – dieselbe Schnittstelle wie bei jedem OpenAI-kompatiblen Endpunkt.
  2. Das Produkt in einfacher Sprache beschreiben. Öffnen Sie We.Inc und geben Sie ein, was Sie entwickeln, etwa: „Eine Oberfläche für einen Programmierpartner. Entwickler können eine Datei einfügen, Fragen dazu stellen und eine Antwort von einer Coding-KI erhalten. Dunkles, klares Design mit Code-Editor links und Chat rechts.“ We.Inc erstellt in Sekunden eine funktionierende React-App, die Sie direkt ausprobieren können.
  3. Qwen-Endpunkt verbinden. Richten Sie im erzeugten Code den Modellaufruf mit Ihrem Schlüssel auf Ihre Qwen-API-URL. Braucht die App einen anderen Prompt oder eine andere Systemnachricht, bearbeiten Sie sie direkt oder bitten Sie die KI um eine Änderung.
  4. Veröffentlichen und bei Bedarf exportieren. Veröffentlichen Sie die App aus dem Baukasten unter einer eigenen Domain oder exportieren Sie den vollständigen React-Code nach GitHub. Da Ihnen der erzeugte Code gehört, gilt das Prinzip offener Gewichte auch für das Entwicklungswerkzeug: keine Anbieterbindung.

Bei einem Tool mit nur einer Funktion dauert es üblicherweise weniger als eine Stunde von der Beschreibung bis zur Veröffentlichung auf einer Domain. Infrastruktur, Authentifizierung und Hosting, die sonst eine Woche kosten können, werden übernommen.

Qwen3.8 und die KI im WeInc-Baukasten

Eine Frage sollten wir direkt beantworten: WeInc nutzt selbst fortschrittliche KI-Modelle für die Erzeugung im Baukasten. Widerspricht das dem Aufbau einer Qwen-App mit WeInc?

Nein. Das ist inzwischen die übliche Architektur. Die KI, die Ihren Code schreibt und bearbeitet (die Baukasten-KI), ist von der KI getrennt, die Ihre App zur Laufzeit aufruft (die Produkt-KI). We.Inc nutzt das Modell, das derzeit bei Codeerstellung über mehrere Dateien und UI-Schlussfolgerungen führend ist. Die erzeugte App kann jede von Ihnen angegebene API aufrufen: Qwen3.8-Max, eine lokale Qwen3.8-27B-Instanz, Claude oder GPT-4o. Sie wählen das passende Werkzeug für jede Ebene aus, statt sich für alles auf ein Modell festzulegen.

Jetzt loslegen

Qwen3.8-Max ist bereits auf OpenRouter verfügbar. Die lokale 27B-Version folgt nächste Woche. Das Zeitfenster, in dem ein früher Start mit einem Modell Reichweite bringt – Zitate, Links und Mundpropaganda –, beträgt ungefähr die ersten zwei Wochen nach der Veröffentlichung.

Beschreiben Sie Ihre Qwen-App auf We.Inc. Der Einstieg ist kostenlos und ohne Kreditkarte; heute können Sie sie auf einer Domain veröffentlichen. Wenn Sie zuerst Tarife vergleichen möchten, finden Sie die Preise unter /pricing. Einen umfassenderen Überblick zur Entwicklung produktionsreifer Apps ohne Programmierung gibt So erstellen Sie eine Web-App ohne Code.

Kostenlos starten · Keine Kreditkarte nötig

Product

Who It's For

Features

Resources

Company

View Sitemap