Alibaba wydało Qwen3.8-Max sierpień 3, 2026 -- po raz pierwszy model Qwen klasy Max (poziom frontier) trafił na rynek z otwartymi wagami. Wersja 27B do uruchomienia lokalnie pojawi się w przyszłym tygodniu. Ten poradnik omawia, co się zmieniło, jak wypada Qwen3.8 w benchmarkach i najszybszą drogę do wypuszczenia prawdziwego produktu na jego bazie już dziś.
Tak. Qwen3.8-Max został wydany sierpień 3, 2026 jako pierwszy model Qwen klasy Max z otwartymi wagami. Możesz go uruchamiać przez dostawców takich jak OpenRouter, Together AI lub oficjalne API Qwen. Lokalnie uruchamialny wariant Qwen3.8-27B z otwartymi wagami jest też planowany na następny tydzień i będzie praktyczny do uruchomienia na wysokiej klasy konsumenckim GPU.
Qwen3.8-Max jest pozycjonowany jako mocny model do kodowania i współpracy, a Alibaba twierdzi, że ustanawia nowy standard w tej kategorii. W praktyce Claude Opus 5 (wydany lipiec 24, 2026) nadal prowadzi w złożonym generowaniu kodu wielu plików i rozumowaniu o architekturze. Qwen3.8-Max jest konkurencyjny w zadaniach jednoplikowych, ma mocne wsparcie kodowania wielojęzycznego, a jego status otwartych wag oznacza, że można go hostować samodzielnie lub dostrajać, czemu modele zamknięte nie dorównają.
Użyj API Qwen lub OpenRouter (który dodał Qwen3.8-Max pierwszego dnia) jako endpointu modelu i zbuduj warstwę produktu kreatorem AI. W We.Inc opisujesz aplikację prostym językiem, od razu dostajesz działającą aplikację React, podłączasz swój klucz API Qwen jako wywołanie modelu i publikujesz na własnej domenie. Wygenerowany kod możesz wyeksportować, więc dostajesz tę samą własność bez uzależnienia, która czyni otwarte wagi atrakcyjnymi. Zacznij za darmo na we.inc.
Sam Qwen3.8-Max to duży model nieprzeznaczony do lokalnego wnioskowania na sprzęcie konsumenckim. Jednak Alibaba ogłosiło Qwen3.8-27B jako osobne wydanie z otwartymi wagami planowane na tydzień sierpień 10, 2026. Rozmiar 27B działa na wysokiej klasy GPU (RTX 4090 z 24GB VRAM wystarcza do wnioskowania kwantyzowanego) i niesie sporo możliwości Max w zadaniach kodowania. Do tego czasu API Qwen i OpenRouter to Twoje najszybsze wejścia.
Alibaba uruchomiło Qwen3.8-Max sierpień 3, 2026 i w ciągu godzin był na pierwszej stronie Hacker News z prawie 1000 punktów. Nagłówek to nie tylko kolejne wydanie modelu: to pierwszy raz, gdy Alibaba wypuściło model klasy Max, czyli swój poziom frontier, z otwartymi wagami. OpenRouter miał go na żywo pierwszego dnia. Lokalnie uruchamialny Qwen3.8-27B pojawi się w przyszłym tygodniu.
TL;DR: Qwen3.8-Max to teraz najsilniejszy model do kodowania z otwartymi wagami dostępny przez API. Jeśli chcesz zbudować na nim produkt już dziś, API Qwen lub OpenRouter uruchomi Cię w kilka minut, a wokół tego endpointu możesz owinąć pełną działającą aplikację za pomocą We.Inc, bez pisania warstwy infrastruktury. Wariant 27B do uruchomienia lokalnie pojawi się w przyszłym tygodniu i będzie działał na GPU 24GB.
Linia Qwen zawsze była mocna jak na swoją klasę rozmiaru. Qwen 3.6-27B zyskał opinię jednego z najlepszych modeli lokalnych w kodowaniu, rozumowaniu i zadaniach wielojęzycznych i nic zbliżonego w tym rozmiarze mu nie dorównywało. Qwen3.8 to skok do poziomu Max, a istotne fakty to:
Otwarte wagi na poziomie frontier. Poprzednie wydania Qwen-Max były tylko przez zamknięte API. Wypuszczenie wag przy tym poziomie możliwości to nagłówek, a nie liczba z benchmarku. Oznacza, że możesz hostować samodzielnie, dostrajać lub uruchamiać za własną zaporą, bez zależności od działania API Alibaba.
Kodowanie i „cowork” to deklarowany główny przypadek użycia. Oficjalny blog pozycjonuje Qwen3.8-Max jako model zbudowany do przepływów tworzenia oprogramowania, gdzie programista i AI wymieniają kontekst przez długą sesję: nie jednorazowe autouzupełnianie, lecz ciągły partner do programowania w parze. Benchmarki wydane z modelem pokazują go na poziomie lub powyżej poprzednich wersji Qwen-Max w HumanEval, MBPP i wieloturowych scenariuszach kodowania.
Wariant lokalny 27B potwierdzony na przyszły tydzień. Wątek na HN potwierdził wydanie Qwen3.8-27B w tygodniu sierpień 10. Qwen3.6-27B jest już powszechnie uważany za najlepszy model lokalny w tej klasie rozmiaru, a wariant 27B wersji 3.8 będzie tym, który programiści uruchomią na własnych maszynach.
OpenRouter pierwszego dnia. To ma praktyczne znaczenie: jeśli już masz klucz OpenRouter, możesz wywołać Qwen3.8-Max od razu, bez żadnej konfiguracji dostawcy.
Trzy wydania ukształtowały frontier w ostatnich dwóch tygodniach: Claude Opus 5 (lipiec 24), otwarte wagi Kimi K3 (koniec lipca, 2.8T parametrów) i teraz Qwen3.8-Max (sierpień 3). Obsługują różne nisze:
| Model | Najlepszy do | Otwarte wagi | Uruchamialny lokalnie |
|---|---|---|---|
| Claude Opus 5 | Złożone generowanie wielu plików, architektura | Nie | Nie |
| Kimi K3 | Zadania z długim kontekstem, dokumenty badawcze | Tak | Nie (2.8T parametrów) |
| Qwen3.8-Max | Kodowanie, wielojęzyczność, długie sesje | Tak | Przez API teraz, 27B lokalnie w przyszłym tygodniu |
| Qwen3.8-27B (wkrótce) | Lokalny asystent kodowania | Tak | Tak, GPU 24GB |
Jeśli chcesz wypuścić produkt wywołujący model frontier i zależy Ci na otwartych wagach, Qwen3.8-Max jest teraz najbardziej praktycznym wyborem. Kimi K3 też ma otwarte wagi, ale przy 2.8 biliona parametrów wymaga sprzętu klasy centrum danych. Qwen3.8-27B będzie pierwszym modelem klasy frontier, który programista może faktycznie uruchomić na stacji roboczej.
Praktyczne przypadki budowy pojawiające się we wczesnym wątku o Qwen3.8:
Asystenci kodowania do długich sesji. Pozycjonowanie „cowork” jest prawdziwe: modele Qwen dobrze radzą sobie z długim kontekstem, co pasuje do sesji, w których budujesz funkcję w dziesiątkach plików, a nie zadajesz jednorazowe pytania. Celem są programiści w mniejszych firmach, którzy chcą wewnętrznego partnera AI do programowania w parze, który mogą hostować samodzielnie.
Wielojęzyczne narzędzia SaaS. Qwen historycznie jest najsilniejszą rodziną modeli w kontekstach kodowania nieanglojęzycznego, zwłaszcza w językach CJK. Zespoły budujące narzędzia dla rynków japońskiego, chińskiego lub koreańskiego już przyjmują go jako bezpośredni zamiennik modeli zorientowanych na angielski.
Dostrojone narzędzia wewnętrzne. Otwarte wagi oznaczają, że dostrajanie wchodzi w grę. Firmy budujące wyspecjalizowane agenty kodowania dla własnych stosów (własne SDK, wewnętrzne API, frameworki dziedzinowe) mogą dostroić Qwen3.8 na swojej bazie kodu w sposób, na jaki modele zamknięte nie pozwalają.
Endpoint modelu to łatwa część. Produkt wokół niego to miejsce, gdzie projekty utykają. Oto konkretna droga z użyciem We.Inc:
Typowy czas od „opisz aplikację” do „na żywo na domenie” to poniżej godziny dla narzędzia z jedną funkcją. Infrastruktura, obsługa uwierzytelniania i hosting, które zwykle zajmują tydzień, są załatwione.
Jedno pytanie warte bezpośredniej odpowiedzi: WeInc używa zaawansowanych modeli AI do generowania wewnątrz samego kreatora. Czy to koliduje z budowaniem aplikacji opartej na Qwen na WeInc?
Nie, i to jest dziś normalna architektura. AI, które pisze i edytuje Twój kod (AI kreatora), jest oddzielne od AI, które Twoja aplikacja wywołuje w czasie działania (AI produktu). We.Inc używa modelu, który obecnie prowadzi w generowaniu kodu wielu plików i rozumowaniu o UI. Aplikacja generowana przez WeInc może wywołać dowolne API, które wskażesz -- Qwen3.8-Max, lokalną instancję Qwen3.8-27B, Claude lub GPT-4o. Wybierasz najlepsze narzędzie na każdej warstwie, a nie wiążesz się z jednym modelem do wszystkiego.
Qwen3.8-Max jest już na żywo w OpenRouter. Wariant lokalny 27B pojawi się w przyszłym tygodniu. Okno, w którym bycie wcześnie z modelem daje dystrybucję -- cytowania, linki, pocztę pantoflową -- to mniej więcej pierwsze dwa tygodnie po premierze.
Opisz swoją aplikację opartą na Qwen w We.Inc, za darmo na start, bez karty, i miej ją na żywo na domenie jeszcze dziś. Jeśli chcesz najpierw porównać plany, cennik jest pod adresem /pricing. Szerszy obraz budowania aplikacji produkcyjnych bez kodu znajdziesz w jak zbudować aplikację webową bez kodu.
Zacznij za darmo · Bez karty kredytowej