Qwen3.8-Max is net als open gewichten uitgebracht. Dit bouwen ontwikkelaars er vandaag mee.

Alibaba bracht Qwen3.8-Max uit op augustus 3, 2026 -- de eerste keer dat een Qwen-model van Max-klasse (frontier-niveau) met open gewichten verscheen. De lokaal draaibare versie van 27B volgt volgende week. Deze gids behandelt wat er veranderde, hoe Qwen3.8 in benchmarks scoort en de snelste weg om er vandaag een echt product bovenop op te leveren.

Veelgestelde vragen

Is Qwen3.8-Max beschikbaar als open gewichten?

Ja. Qwen3.8-Max werd op augustus 3, 2026 uitgebracht als eerste Qwen-model van Max-klasse met open gewichten. Je kunt het draaien via aanbieders als OpenRouter, Together AI of de officiële Qwen API. Een lokaal draaibare open-weightsvariant Qwen3.8-27B staat ook gepland voor de week erna, die praktisch te draaien is op een consumenten-GPU uit het hogere segment.

Hoe verhoudt Qwen3.8-Max zich tot Claude of GPT voor programmeren?

Qwen3.8-Max wordt gepositioneerd als een sterk model voor programmeren en samenwerking, waarbij Alibaba beweert dat het in die categorie een nieuwe lat legt. In de praktijk loopt Claude Opus 5 (uitgebracht op juli 24, 2026) nog voorop bij complexe codegeneratie met meerdere bestanden en redeneren over architectuur. Qwen3.8-Max is concurrerend voor taken met één bestand, heeft sterke ondersteuning voor meertalig programmeren en dat het open gewichten heeft, betekent dat het zelf gehost of gefinetuned kan worden, wat gesloten modellen niet kunnen evenaren.

Hoe bouw ik een app met Qwen3.8-Max zonder infrastructuur te beheren?

Gebruik de Qwen API of OpenRouter (dat Qwen3.8-Max op dag één toevoegde) als modelendpoint en bouw de productlaag met een AI-builder. Met We.Inc beschrijf je de app in gewone taal, krijg je meteen een live werkende React-app, koppel je je Qwen API-sleutel als modelaanroep en publiceer je op een eigen domein. De gegenereerde code kun je zelf exporteren, dus je krijgt hetzelfde bezit zonder lock-in dat open gewichten aantrekkelijk maakt. Begin gratis op we.inc.

Kan ik Qwen3.8-Max lokaal draaien?

Qwen3.8-Max zelf is een groot model dat niet is ontworpen voor lokale inferentie voor consumenten. Alibaba heeft echter Qwen3.8-27B aangekondigd als aparte open-weightsrelease die gepland staat voor de week van augustus 10, 2026. De omvang van 27B draait op een GPU uit het hogere segment (een RTX 4090 met 24GB VRAM volstaat voor gekwantiseerde inferentie) en draagt veel van het vermogen van de Max voor codeertaken. Tot die tijd zijn de Qwen API en OpenRouter je snelste toegangsroutes.

Alibaba lanceerde Qwen3.8-Max op augustus 3, 2026 en binnen enkele uren stond het op de voorpagina van Hacker News met bijna 1000 punten. De kop is niet zomaar weer een modeldrop: dit is de eerste keer dat Alibaba een model van de Max-klasse, hun frontier-niveau, met open gewichten uitbrengt. OpenRouter had het op dag één live. Volgende week volgt een lokaal draaibare Qwen3.8-27B.

TL;DR: Qwen3.8-Max is nu het sterkste open-weights-codeermodel dat via een API beschikbaar is. Als je er vandaag een product op wilt bouwen, brengen de Qwen API of OpenRouter je in minuten aan de praat en kun je met We.Inc een volledige werkende app rond dat endpoint wikkelen zonder de infrastructuurlaag te schrijven. De lokaal draaibare variant van 27B verschijnt volgende week en draait op een GPU van 24GB.

Wat er veranderde in Qwen3.8

De Qwen-lijn is altijd sterk geweest voor zijn omvangklasse. Qwen 3.6-27B verwierf een reputatie als een van de beste lokale modellen voor programmeren, redeneren en meertalige taken en niets dichtbij kwam in die omvang in de buurt. Qwen3.8 is de sprong naar het Max-niveau en de relevante feiten zijn:

Open gewichten op frontier-niveau. Eerdere Qwen-Max-releases waren alleen via een gesloten API. Gewichten uitbrengen op dit niveau van vermogen is de kop, geen benchmarkgetal. Het betekent dat je zelf kunt hosten, finetunen of het achter je eigen firewall kunt draaien zonder ervan af te hangen dat de API van Alibaba online blijft.

Coderen en "cowork" is het vermelde hoofdgebruik. De officiële blog positioneert Qwen3.8-Max als een model gebouwd voor softwareontwikkelworkflows waarin een ontwikkelaar en een AI tijdens een lange sessie context uitwisselen: geen eenmalige autocomplete, maar een doorlopende pair-programmer. Benchmarks die met het model zijn uitgebracht tonen het op of boven eerdere Qwen-Max-versies op HumanEval, MBPP en codeerscenario's met meerdere beurten.

Lokale variant van 27B bevestigd voor volgende week. De HN-thread bevestigde dat er een release van Qwen3.8-27B komt in de week van augustus 10. Qwen3.6-27B wordt al breed gezien als het beste lokale model in die omvangklasse en de variant van 27B van 3.8 wordt degene die ontwikkelaars op hun eigen machines draaien.

OpenRouter op dag één. Dit is praktisch van belang: als je al een OpenRouter-sleutel hebt, kun je Qwen3.8-Max nu meteen aanroepen zonder enige inrichting bij een aanbieder.

Hoe Qwen3.8-Max in het huidige landschap past

Drie releases bepaalden de afgelopen twee weken het frontier: Claude Opus 5 (juli 24), de open gewichten van Kimi K3 (eind juli, 2,8T parameters) en nu Qwen3.8-Max (augustus 3). Ze bedienen verschillende niches:

ModelHet beste voorOpen gewichtenLokaal draaibaar
Claude Opus 5Complexe generatie met meerdere bestanden, architectuurNeeNee
Kimi K3Taken met lange context, onderzoeksdocumentenJaNee (2,8T parameters)
Qwen3.8-MaxProgrammeren, meertalig, lange sessiesJaNu via API, 27B lokaal volgende week
Qwen3.8-27B (komt eraan)Lokale codeerassistentJaJa, GPU van 24GB

Als je een product wilt opleveren dat een frontier-model aanroept en je geeft om open gewichten, is Qwen3.8-Max nu de meest praktische keuze. Kimi K3 heeft ook open gewichten, maar bij 2,8 biljoen parameters vraagt het datacenterhardware om te draaien. De Qwen3.8-27B wordt het eerste model van frontier-niveau dat een ontwikkelaar echt op een werkstation kan draaien.

Wat mensen er vandaag mee bouwen

De praktische bouwgevallen die in de vroege Qwen3.8-thread opduiken:

Codeerassistenten voor lange sessies. De positionering "cowork" is echt: Qwen-modellen gaan goed om met lange context, waardoor ze geschikt zijn voor sessies waarin je een functie over tientallen bestanden bouwt in plaats van eenmalige vragen te stellen. Ontwikkelaars bij kleinere bedrijven die een interne AI pair-programmer willen die ze zelf kunnen hosten, zijn het doelwit.

Meertalige SaaS-tools. Qwen is van oudsher de sterkste modelfamilie voor niet-Engelse codeercontexten, vooral CJK-talen. Teams die tools bouwen voor de Japanse, Chinese of Koreaanse markt nemen het al over als drop-in vervanging voor eerst-Engelse modellen.

Gefinetunede interne tools. Open gewichten betekent dat finetunen mogelijk is. Bedrijven die gespecialiseerde codeeragenten bouwen voor hun eigen stacks (eigen SDK's, interne API's, domeinspecifieke frameworks) kunnen Qwen3.8 op hun codebase afstemmen op een manier die gesloten modellen niet toestaan.

De snelste weg naar een Qwen3.8-Max-app

Het modelendpoint is het makkelijke deel. Het product eromheen is waar projecten vastlopen. Hier is het concrete pad met We.Inc:

  1. Haal een Qwen API-sleutel op qwen.ai, of gebruik OpenRouter als je daar al een account hebt. Je krijgt een URL en een sleutel -- dezelfde interface als elk endpoint dat compatibel is met OpenAI.
  1. Beschrijf het product in gewone taal. Open We.Inc en typ wat je bouwt: "Een pair-programmer-UI waarin een ontwikkelaar een bestand kan plakken, er vragen over kan stellen en een antwoord krijgt van een codeer-AI. Schone donkere interface met een code-editor links en chat rechts." We.Inc genereert in seconden een live, werkende React-app waarop je kunt klikken.
  1. Koppel je Qwen-endpoint. Wijs in de gegenereerde code de modelaanroep naar je Qwen API-URL met je sleutel. Als de app een andere prompt of systeembericht nodig heeft, bewerk die dan inline of zeg tegen de AI dat die het moet wijzigen.
  1. Publiceer en exporteer eventueel. Publiceer vanuit de builder op een eigen domein of exporteer de volledige React-codebase naar je GitHub. Omdat de gegenereerde code van jou is, geldt hetzelfde open-gewichtenprincipe dat je naar Qwen bracht ook voor je bouwtool: geen lock-in.

De typische tijd van "beschrijf de app" tot "live op een domein" is minder dan een uur voor een tool met één functie. De infrastructuur, authenticatiekoppeling en hosting die normaal het weeklange deel zouden zijn, worden afgehandeld.

Qwen3.8 en de builder-AI in WeInc

Een vraag die het waard is direct te beantwoorden: WeInc gebruikt geavanceerde AI-modellen voor de AI-generatie in de builder zelf. Botst dat met het bouwen van een app op Qwen bovenop WeInc?

Nee, en dit is nu de normale architectuur. De AI die je code schrijft en bewerkt (de builder-AI) staat los van de AI die je app tijdens runtime aanroept (de product-AI). We.Inc gebruikt het model dat momenteel voorop loopt bij codegeneratie met meerdere bestanden en UI-redenering. De app die WeInc genereert kan elke API aanroepen die je opgeeft -- Qwen3.8-Max, een lokale instantie van Qwen3.8-27B, Claude of GPT-4o. Je kiest op elke laag het beste gereedschap, in plaats van je voor alles aan één model te binden.

Begin met bouwen

Qwen3.8-Max staat nu live op OpenRouter. De lokale variant van 27B volgt volgende week. Het venster waarin vroeg zijn met een model je distributie oplevert -- citaten, links, mond-tot-mondreclame -- is ruwweg de eerste twee weken na de lancering.

Beschrijf je app op basis van Qwen op We.Inc, gratis om te starten zonder kaart, en laat hem vandaag nog live gaan op een domein. Als je eerst abonnementen wilt vergelijken, staan de prijzen op /pricing. Voor een bredere blik op het bouwen van productie-apps zonder code, zie hoe je een webapp bouwt zonder code.

Gratis beginnen · Geen creditcard nodig

Product

Who It's For

Features

Resources

Company

View Sitemap