阿里巴巴于 2026 年 8 月 3 日(3, 2026)发布首个开放权重的 Max 级 Qwen3.8 模型。可本地运行的 27B 版本预计下周推出。本文说明变化、基准比较,以及快速推出实际产品的路径。
阿里巴巴于 2026 年 8 月 3 日(3, 2026)推出 Qwen3.8-Max,数小时内便以近 1,000 点登上 Hacker News 首页。重点不只是又推出一款模型:这是阿里巴巴首度以开放权重发布 Max 级前沿模型。OpenRouter 首日就提供使用;可本地运行的 Qwen3.8-27B 则预计下周推出。
重点摘要:Qwen3.8-Max 是目前可通过 API 使用的强大开放权重编程模型。若今天就想用它推出产品,可通过 Qwen API 或 OpenRouter 在几分钟内开始,并使用 We.Inc 建立完整应用程序,无需自行编写基础设施层。27B 本地版本预计下周推出,可在 24GB GPU 上运行。
Qwen 系列一向在自身规模级距中表现良好。Qwen 3.6-27B 在编程、推理和多语言任务中获得优秀的本地模型评价,同规模产品难以相比。Qwen3.8 则升级到 Max 级,重点如下:
前沿级模型开放权重。先前的 Qwen-Max 版本仅提供封闭 API。此次开放如此高能力模型的权重,是重点所在,而非单一基准数字。这让使用者能自架、微调,或在自有防火墙后运行,不必依赖阿里巴巴 API 持续提供服务。
编程与“协作”是官方主打用途。官方部落格将 Qwen3.8-Max 定位为软件开发工作流程用模型,开发者和 AI 可在长时间会话中持续交换上下文。它不只是一次性自动补全,而是持续协作的程式伙伴。随模型公布的基准结果显示,它在 HumanEval、MBPP 和多轮编程情境中达到或超过先前 Qwen-Max 版本。
确认下周推出 27B 本地版本。Hacker News 讨论串确认 Qwen3.8-27B 预计于 8 月 10 日当周推出。Qwen3.6-27B 已被广泛视为该规模最佳本地模型,新版 27B 也将是开发者可在个人电脑运行的选择。
首日即可通过 OpenRouter 使用。这点很实用:若您已有 OpenRouter 金钥,无需设定其他供应商就能立即调用 Qwen3.8-Max。
过去两周有三项发布影响前沿模型市场:Claude Opus 5(7 月 24 日)、Kimi K3 开放权重版(7 月下旬,2.8T 参数),以及 Qwen3.8-Max(8 月 3 日)。三者适合不同用途:
| 模型 | 最适用途 | 开放权重 | 可在本地运行 |
|---|---|---|---|
| Claude Opus 5 | 复杂多文件程式码生成、架构推理 | 否 | 否 |
| Kimi K3 | 长上下文任务、研究文件 | 是 | 否(2.8T 参数) |
| Qwen3.8-Max | 编程、多语言、长会话 | 是 | 目前通过 API;27B 本地版下周推出 |
| Qwen3.8-27B(即将推出) | 本地编程助手 | 是 | 可以,需要 24GB GPU |
若要推出调用前沿模型的产品,并重视开放权重,Qwen3.8-Max 目前是最实用的选择。Kimi K3 也是开放权重,但 2.8 兆参数意味着需要资料中心级硬体才能运行。Qwen3.8-27B 则会是开发者能在工作站实际运行的首款前沿等级模型。
Qwen3.8 讨论串刚开始出现的实际建置案例包括:
长会话程式设计助手。“协作”定位并非空谈:Qwen 模型擅长处理长上下文,适合开发者跨数十个档案建立功能,而非只问一次问题。想自架内部 AI 程式伙伴的小型公司正是目标客群。
多语言 SaaS 工具。Qwen 长期以来是非英语编程情境的强势模型家族,尤其擅长中日韩(CJK)语言。面向日文、中文或韩文市场开发工具的团队,已开始将其作为英语优先模型的替代方案。
微调的内部工具。开放权重让微调成为可能。若企业要为自己的技术堆叠(专有 SDK、内部 API、领域专用框架)建立专用程式设计代理,可用自家代码库微调 Qwen3.8;封闭模型无法如此处理。
模型端点很容易设定;真正让专案停滞的是产品本身。以下是使用 We.Inc 的具体流程:
对单一功能工具而言,从“描述应用程序”到“发布到网域”通常不到一小时。原本可能花一周处理的基础设施、身份验证和托管都会由平台处理。
有个问题值得直接回答:建站工具内部使用先进 AI 模型产生程式码,这和在该平台上制作 Qwen 应用程序是否冲突?
不会,这也是目前常见的架构。负责撰写和修改代码的建置 AI,与应用程序运行时调用的 AI 是不同层。We.Inc 会使用当前擅长多档案代码生成和介面推理的模型。生成的应用程序可调用您指定的任何 API,例如 Qwen3.8-Max、本地 Qwen3.8-27B、Claude 或 GPT-4o。每个层级各选最合适的工具,不必所有用途都绑在同一模型上。
Qwen3.8-Max 已可在 OpenRouter 使用。本地 27B 版本预计下周推出。新模型推出后,抢先采用所带来的曝光机会(引用、连结和口碑)通常约只有前两周。
在 We.Inc 描述 Qwen 应用程序,即可免费开始、不需信用卡,今天就发布到网域。想先比较方案,可查看价格。想了解更广泛的无代码生产应用程序建置方式,请阅读如何无代码建立网页应用程序。
是。Qwen3.8-Max 于 2026 年 8 月 3 日(3, 2026)发布,是首个采用开放权重的 Max 级 Qwen 模型。可通过 OpenRouter、Together AI 或官方 Qwen API 使用。另有可本地运行的 Qwen3.8-27B 开放权重版本计划于下一周推出,高阶消费级 GPU 即可运行。
阿里巴巴将 Qwen3.8-Max 定位为强大的编程与协作模型,并声称在该类别中树立新标准。复杂多文件代码生成与架构推理方面,2026 年 7 月 24 日(24, 2026)推出的 Claude Opus 5 仍领先。Qwen 适用于单文件任务,具备多语言编程能力;开放权重也代表可自架或微调,而封闭模型无法这样使用。
将 Qwen API 或 OpenRouter(首日就加入 Qwen3.8-Max)设为模型端点,再用 AI 建站工具制作产品。通过 We.Inc,您可用白话描述应用程序,立即取得可运行的 React 应用,将 Qwen API 金钥设为模型调用端点,再发布到自订网域。生成的程式码可汇出,拥有与开放权重相同的自主性。可从 we.inc 免费开始。
Qwen3.8-Max 本身规模较大,不适合消费级本地推理。不过阿里巴巴已宣布另一款开放权重模型 Qwen3.8-27B,预计于 8月10, 2026年当周发布。27B 模型可在高阶 GPU 上运行;例如配备 24GB VRAM 的 RTX 4090 足以进行量化推理,并保有许多 Max 模型的编程能力。在此之前,Qwen API 和 OpenRouter 是最快的使用方式。
免费开始 · 无需信用卡