Alibaba ra mắt Qwen3.8-Max vào ngày ngày 3, 2026 -- lần đầu một mô hình Qwen cấp Max (cấp độ tiên phong) được phát hành với trọng số mở. Phiên bản 27B có thể chạy cục bộ sẽ ra mắt vào tuần tới. Hướng dẫn này trình bày những thay đổi, so sánh điểm chuẩn Qwen3.8 và con đường nhanh nhất để hôm nay phát hành một sản phẩm thực tế dựa trên mô hình này.
Có. Qwen3.8-Max được phát hành vào ngày ngày 3, 2026 và là mô hình Qwen cấp Max đầu tiên có trọng số mở. Bạn có thể chạy mô hình qua các nhà cung cấp như OpenRouter, Together AI hoặc API chính thức của Qwen. Một biến thể Qwen3.8-27B trọng số mở có thể chạy cục bộ cũng dự kiến ra mắt vào tuần tiếp theo, phù hợp để chạy trên GPU tiêu dùng cao cấp.
Qwen3.8-Max được định vị là mô hình mạnh cho lập trình và cộng tác, Alibaba cho rằng nó thiết lập chuẩn mới trong hạng mục này. Trên thực tế, Claude Opus 5 (ra mắt ngày ngày 24, 2026) vẫn dẫn đầu về tạo mã phức tạp trên nhiều tệp và suy luận kiến trúc. Qwen3.8-Max cạnh tranh tốt với tác vụ một tệp, hỗ trợ lập trình đa ngôn ngữ mạnh, và trạng thái trọng số mở cho phép tự lưu trữ hoặc tinh chỉnh, điều mà mô hình đóng không làm được.
Dùng API Qwen hoặc OpenRouter (đã thêm Qwen3.8-Max ngay ngày đầu) làm điểm cuối mô hình, rồi xây dựng lớp sản phẩm bằng trình tạo AI. Với We.Inc, bạn mô tả ứng dụng bằng ngôn ngữ thông thường, nhận ngay ứng dụng React đang hoạt động, kết nối khóa API Qwen để gọi mô hình và xuất bản lên tên miền tùy chỉnh. Bạn có thể xuất mã đã tạo, nhờ vậy có được quyền sở hữu không bị khóa nền tảng như ưu điểm của trọng số mở. Bắt đầu miễn phí tại we.inc.
Bản thân Qwen3.8-Max là mô hình lớn, không được thiết kế để chạy suy luận cục bộ trên thiết bị tiêu dùng. Tuy nhiên, Alibaba đã công bố Qwen3.8-27B là bản phát hành trọng số mở riêng, dự kiến trong tuần bắt đầu ngày ngày 10, 2026. Kích thước 27B chạy được trên GPU cao cấp (RTX 4090 với 24GB VRAM đủ cho suy luận lượng tử hóa) và có nhiều năng lực lập trình của bản Max. Cho đến lúc đó, API Qwen và OpenRouter là cách bắt đầu nhanh nhất.
Alibaba ra mắt Qwen3.8-Max vào ngày ngày 3, 2026, và chỉ trong vài giờ mô hình đã lên trang đầu Hacker News với gần 1000 điểm. Tiêu đề không chỉ nói về một lần ra mắt mô hình nữa: đây là lần đầu Alibaba phát hành mô hình cấp Max -- phân khúc tiên phong của họ -- với trọng số mở. OpenRouter đã cung cấp mô hình ngay ngày đầu. Qwen3.8-27B có thể chạy cục bộ sẽ ra mắt vào tuần tới.
Tóm tắt: Qwen3.8-Max hiện là mô hình lập trình trọng số mở mạnh nhất có thể dùng qua API. Nếu muốn xây sản phẩm dựa trên nó ngay hôm nay, API Qwen hoặc OpenRouter giúp bạn bắt đầu trong vài phút, và bạn có thể tạo ứng dụng hoàn chỉnh hoạt động quanh điểm cuối đó bằng We.Inc mà không cần viết lớp hạ tầng. Biến thể 27B có thể chạy cục bộ sẽ ra mắt vào tuần tới và chạy được trên GPU 24GB.
Dòng Qwen luôn có năng lực mạnh so với kích thước của mình. Qwen 3.6-27B nổi tiếng là một trong những mô hình cục bộ tốt nhất về lập trình, suy luận và tác vụ đa ngôn ngữ, chưa có mô hình nào cùng kích thước sánh được. Qwen3.8 là bước nhảy lên cấp Max, với những thông tin đáng chú ý sau:
Trọng số mở đạt cấp độ tiên phong. Các bản Qwen-Max trước đây chỉ có API đóng. Việc phát hành trọng số với năng lực ở cấp độ này mới là tin chính, chứ không phải con số điểm chuẩn. Điều đó nghĩa là bạn có thể tự lưu trữ, tinh chỉnh hoặc chạy phía sau tường lửa của mình mà không phụ thuộc vào việc API Alibaba có hoạt động hay không.
Lập trình và “cộng tác” là trường hợp sử dụng chính được công bố. Blog chính thức định vị Qwen3.8-Max là mô hình dành cho quy trình phát triển phần mềm, nơi nhà phát triển và AI trao đổi ngữ cảnh trong một phiên dài: không chỉ là tự động hoàn thành một lần mà là cộng tác lập trình liên tục. Điểm chuẩn phát hành cùng mô hình cho thấy kết quả ngang bằng hoặc cao hơn các phiên bản Qwen-Max trước đây trên HumanEval, MBPP và các tình huống lập trình nhiều lượt.
Đã xác nhận có bản 27B chạy cục bộ vào tuần tới. Chủ đề trên HN xác nhận Qwen3.8-27B sẽ ra mắt trong tuần bắt đầu ngày 10 tháng 8. Qwen3.6-27B vốn đã được xem rộng rãi là mô hình cục bộ tốt nhất ở kích thước đó; phiên bản 27B của 3.8 sẽ là lựa chọn mà nhà phát triển chạy trên máy của họ.
Có trên OpenRouter ngay ngày đầu. Điều này có ý nghĩa thực tế: nếu đã có khóa OpenRouter, bạn có thể gọi Qwen3.8-Max ngay bây giờ mà không cần thiết lập nhà cung cấp nào.
Ba lần ra mắt định hình phân khúc tiên phong trong hai tuần qua: Claude Opus 5 (ngày 24 tháng 7), trọng số mở Kimi K3 (cuối tháng 7, 2.8T tham số), và giờ là Qwen3.8-Max (ngày 3 tháng 8). Mỗi mô hình phù hợp với một nhu cầu khác nhau:
| Mô hình | Phù hợp nhất cho | Trọng số mở | Chạy cục bộ được không |
|---|---|---|---|
| Claude Opus 5 | Tạo mã phức tạp trên nhiều tệp, kiến trúc | Không | Không |
| Kimi K3 | Tác vụ ngữ cảnh dài, tài liệu nghiên cứu | Có | Không (2.8T tham số) |
| Qwen3.8-Max | Lập trình, đa ngôn ngữ, phiên làm việc dài | Có | Hiện chạy qua API, bản 27B cục bộ tuần tới |
| Qwen3.8-27B (sắp ra mắt) | Trợ lý lập trình cục bộ | Có | Có, GPU 24GB |
Nếu muốn phát hành sản phẩm gọi mô hình tiên phong và quan tâm đến trọng số mở, Qwen3.8-Max hiện là lựa chọn thực tế nhất. Kimi K3 cũng có trọng số mở, nhưng với 2.8 nghìn tỷ tham số, cần phần cứng trung tâm dữ liệu để chạy. Qwen3.8-27B sẽ là mô hình đầu tiên ở cấp độ tiên phong mà nhà phát triển thực sự có thể chạy trên máy trạm.
Những trường hợp ứng dụng thực tế bắt đầu xuất hiện trong chủ đề đầu tiên về Qwen3.8:
Trợ lý lập trình trong phiên dài. Định vị “cộng tác” là có thật: mô hình Qwen xử lý ngữ cảnh dài tốt, phù hợp với các phiên xây dựng tính năng trên hàng chục tệp thay vì hỏi một câu rồi dừng. Nhóm mục tiêu là nhà phát triển ở công ty nhỏ muốn tự lưu trữ một trợ lý lập trình AI nội bộ.
Công cụ SaaS đa ngôn ngữ. Trong lịch sử, Qwen là dòng mô hình mạnh nhất cho ngữ cảnh lập trình không dùng tiếng Anh, đặc biệt là các ngôn ngữ Đông Á. Các nhóm phát triển công cụ cho thị trường Nhật Bản, Trung Quốc hoặc Hàn Quốc đang dùng nó thay thế trực tiếp cho mô hình ưu tiên tiếng Anh.
Công cụ nội bộ được tinh chỉnh. Trọng số mở cho phép tinh chỉnh mô hình. Các công ty xây dựng tác nhân lập trình chuyên dụng cho hệ thống của mình (SDK độc quyền, API nội bộ, framework theo lĩnh vực) có thể tinh chỉnh Qwen3.8 trên mã nguồn của họ theo cách mà mô hình đóng không cho phép.
Điểm cuối mô hình là phần dễ. Sản phẩm xây quanh nó mới là nơi dự án bị đình trệ. Sau đây là quy trình cụ thể bằng We.Inc:
Với một công cụ có một tính năng, thời gian đi từ “mô tả ứng dụng” đến “hoạt động trên tên miền” thường dưới một giờ. Hạ tầng, kết nối xác thực và lưu trữ vốn thường mất cả tuần sẽ được xử lý sẵn.
Có một câu hỏi cần trả lời trực tiếp: WeInc dùng các mô hình AI tiên tiến để tạo nội dung bằng AI bên trong trình tạo. Điều đó có mâu thuẫn với việc xây ứng dụng chạy bằng Qwen bên trên WeInc không?
Không, và đây là kiến trúc bình thường hiện nay. AI viết và chỉnh sửa mã của bạn (AI của trình tạo) tách biệt với AI mà ứng dụng gọi khi chạy (AI của sản phẩm). We.Inc dùng mô hình hiện dẫn đầu về tạo mã nhiều tệp và suy luận giao diện người dùng. Ứng dụng WeInc tạo ra có thể gọi bất kỳ API nào bạn chỉ định -- Qwen3.8-Max, một phiên bản Qwen3.8-27B chạy cục bộ, Claude hoặc GPT-4o. Bạn đang chọn công cụ tốt nhất cho từng lớp, chứ không buộc phải dùng một mô hình cho tất cả.
Qwen3.8-Max hiện đã có trên OpenRouter. Biến thể 27B chạy cục bộ sẽ ra mắt vào tuần tới. Khoảng thời gian để được chú ý khi đi đầu với mô hình mới -- được trích dẫn, dẫn liên kết, truyền miệng -- thường là hai tuần đầu sau khi ra mắt.
Mô tả ứng dụng dùng Qwen của bạn tại We.Inc, bắt đầu miễn phí không cần thẻ và đưa ứng dụng lên tên miền ngay hôm nay. Nếu muốn so sánh gói trước, xem giá tại /pricing. Để xem tổng quan hơn về xây dựng ứng dụng sẵn sàng sản xuất mà không cần mã, hãy đọc cách tạo ứng dụng web không cần mã.
Bắt đầu miễn phí · Không cần thẻ tín dụng