模型发布

Qwen3.8 Preview 开放试用,权重仍待发布

Preview 已在三款产品可试,开放权重、技术报告与独立评测仍待补齐。

2026年7月20日 · 周一深度报告中置信重要度 4/5
#Qwen#Qwen3.8#开放权重#Qoder#模型预览

本文要点

  • Qwen3.8 从预告信号变成 Max-Preview 已在三款产品可试。
  • Qwen Code 官方仓把 Preview 加入 Token Plan 内置模型列表。
  • 开放权重仍停留在 soon,许可证、模型卡与下载地址没有出现。

阅读辅助

先看数字、证据和来源,再读正文。

2.4 万亿厂商自报参数量
3 个首发试用入口
5 条 Claim Audit

Qwen3.8-Max-Preview 已在 Token Plan、Qoder 和 QoderWork 三个入口开放试用。

3 个时间点

2026-07-19 14:22 +08:00 · Qwen Code 官方仓合并 PR #7199,把 Qwen3.8-Max-Preview 加入 Token Plan 内置模型列表。

5 个来源3 个非 X 来源

这条消息值得看的不是“一个 2.4 万亿参数模型已经开源”,而是 Qwen 把产品试用和开放权重拆成了两个时点。过去 24 小时内已经发生的是:Qwen3.8-Max-Preview 进入 Token Plan、Qoder 和 QoderWork,用户可以从这 3 个入口试用预览版。

确定事实是,Qwen Code 官方仓在北京时间 7 月 19 日 14:22合并 PR #7199,把 Qwen3.8-Max-Preview 加入 Token Plan 内置模型列表;Qwen 官方随后在 16:29发布预告,Qoder 官方账号也在同日确认该 Preview 已上线。这里的现在状态只覆盖官方点名或代码变更直接涉及的产品入口。

不确定部分更多。Qwen 所称 2.4 万亿参数尚无模型卡或技术报告支持,激活参数、架构、上下文长度和推理资源均未披露;“仅次于 Fable 5”前面带有 “We believe”,属于厂商自述。更关键的是,原文说 “going open-weight soon”,开放权重是未来状态,不是已经完成的发布。

对开发者而言,现在可以做的是在三款产品里验证 Preview 的编码与工作流表现。对模型部署者、研究者和基础设施团队而言,决定能否本地部署、复现评测和估算成本的材料仍未出现,因此不应依据总参数或厂商排名提前制定容量计划。

先把四种状态拆开

Qwen 原帖把多种时态压在一段公告里。若不逐句拆分,很容易把预览上线、模型发布过程和未来开放权重写成同一件已经完成的事。

官方原话忠实中文状态本期能确认什么不能扩大成什么
Qwen3.8 is launchingQwen3.8 正在推出发布过程已经启动不能写成所有版本、接口与材料均已完整发布
going open-weight soon将很快开放权重厂商作出未来预告不能写成已经开源、已经可下载或已有许可证
Max-Preview made its debutMax-Preview 已经首发预览版进入指定产品不能写成稳定正式版或通用 API 已全面上架
try it out用户已可试用三个产品入口可试不能扩展到所有地区、套餐和部署方式

这组区分决定了标题口径。“Preview 开放试用”是已经发生的产品状态,“权重仍待发布”是尚未发生的交付状态。二者可以同时为真,也分别服务于不同用户:前者让产品用户先接触模型,后者才允许开源社区自行下载、部署、量化和审计。

官方使用 “this model is continuously evolving”,还意味着当前形态仍在持续迭代。Preview 这个命名本身也提示,后续权重版本是否与当前产品内版本一致,尚无答案。即使未来出现同名权重,也需要核对检查点、训练截止时间、上下文配置和推理模板,不能默认两者完全等价。

三个入口的证据强度并不相同

三入口清单来自 Qwen 官方 X:Alibaba Token Plan、Qoder 与 QoderWork。非 X 交叉证据来自 QwenLM 官方组织下的 Qwen Code 仓库:PR #7199 于 7 月 19 日创建并合并,改动把 qwen3.8-max-preview 加入 Token Plan 的内置模型列表和 VS Code 订阅方案定义。

因此,Token Plan 入口有官方 X 与当天官方代码变更交叉确认,且 PR 的标题、正文和文件改动都直接指向本次 Preview。它证明 Qwen Code 在当天加入了对应配置,但不能单独证明每个地区、每种账户都拥有相同权限,也不能把 Qwen Code 的模型列表扩展成通用按量 API 全面上架。

Qoder 的证据是 Qwen 官方 X 加 Qoder 官方 X。Qoder 账号在北京时间 7 月 19 日 21:47写明 “Qwen3.8-Max-Preview is live”,可以确认 Qoder 端的现在状态。不过,本次抓取到的非 X Qoder 产品页没有直接出现模型名,所以这一路仍缺产品内公开目录的交叉确认。

QoderWork 的边界更窄:Qwen 官方公告明确把它列为可试入口,千问 AI 平台也有 QoderWork 官方产品页,但抓取到的公开正文没有直接列出 Qwen3.8-Max-Preview。因此本文保留“三入口已可试”的官方事实,同时在 claim audit 中说明,QoderWork 的即时状态仍主要依赖 Qwen 官方单帖。

入口已有证据可确认状态尚不能确认
Token PlanQwen 官方 X;Qwen Code 当日合并 PRPreview 已加入 Token Plan 与 Qwen Code 配置通用按量 API、全部地区与套餐均已开放
QoderQwen 官方 X;Qoder 官方 XQoder 端 Preview 已上线非 X 产品目录是否同步展示模型
QoderWorkQwen 官方 X官方列为首发试用入口非 X 页面是否已直接点名模型
开放权重交付Qwen 官方公告使用 soon这是未来承诺发布日期、许可证、下载页与文件规格

2.4 万亿参数目前能说明什么

2.4 万亿参数来自 Qwen 官方账号,Qoder 官方账号也重复了这一数字。后者属于同一厂商产品体系的发布口径,能够证明数字在官方传播中一致,却不构成独立技术核验。当前没有公开技术报告、模型卡或权重文件让外部计算参数规模。

总参数也不等于单次推理激活参数。如果 Qwen3.8 采用稀疏混合专家架构,单次前向传播可能只调用总参数的一部分;如果架构另有设计,内存、通信和算力需求又会不同。在激活参数、专家数量、路由方式、精度和上下文配置缺失时,仅凭 2.4T 无法推导显存占用、每 Token 成本、吞吐量或部署门槛。

同样不能从参数总量推导质量。参数规模是架构描述的一部分,模型效果还取决于训练数据、训练算力、后训练方法、推理配置和评测任务。Preview 已进入产品,能让用户获得任务级体验,却不能替代受控基准;个别演示或体感也不能验证一个总排名。

Qwen 对能力的原话带有两层限定。第一层是 “We believe”,说明这是厂商判断。第二层是 “second only to Fable 5”,却没有给出采用哪些任务、对比哪个版本、如何汇总分数,也没有披露是否启用工具、思考预算或特定系统提示。因此,忠实中文只能写成“Qwen 自称仅次于 Fable 5”,不能写成“独立评测全球第二”。

为什么先上 Preview、后给权重

从产品路径看,先把 Preview 放进 Token Plan 与开发工具,可以更快收集真实任务反馈。Token Plan 提供模型访问入口,Qoder 和 QoderWork 则把模型直接放入编码与工作流环境。厂商可以观察模型在长任务、工具调用、代码修改和交互延迟上的表现,再继续调整版本。

但这种路径也带来可验证性差异。产品内 Preview 的服务端配置由平台控制,外部用户通常看不到确切检查点、量化方式、采样策略或路由细节;开放权重则允许研究者固定环境、离线复现、检查架构并测试不同推理栈。两者不是“先体验一下”和“稍后下载”这么简单,而是可观察范围不同。

对开源生态而言,真正的发布包至少应包含权重、许可证、模型卡、配置文件、分词器、聊天模板、推理示例和硬件建议。若是大规模 MoE,还需要解释专家并行、量化兼容性和推荐部署框架。当前公告没有给出这些内容,也没有明确 “soon” 的截止时间。

判断权重尚未发布,不需要依赖组织主页的负向检索。直接证据是公告使用未来时态 “going open-weight soon”,同时没有给出具体权重页、许可证、模型卡或发布日期。后续一旦出现正式原文页,应以该页重新核验版本和发布时间,而不是沿用今天的状态。

新鲜日期锚点为何重要

这条报道若只有 X 公告,核心产品状态仍会集中在单一社交平台来源。Qwen Code 的当日合并 PR 提供了更强的日期和语义交叉:它直接修改 Token Plan 模型配置,并由官方组织仓库合并,而不是用无关公司新闻或普通首页充当日期证明。

但代码锚点也有明确上限。它能证明 Qwen Code 当天接入 Token Plan 的该模型,不能自动把 Qoder、QoderWork、通用 API 和开放权重一起升级为非 X 多源确认。价格页当前确实列出 Qwen3.8-Max-Preview,但页面原始发布日期早于本次事件,因此本文只把它作为当前产品状态背景。

这种逐入口核对比“官网已更新”更繁琐,却能避免状态漂移:订阅价格页出现模型,证明的是订阅产品可用;开发工具账号说 “is live”,证明的是该工具端上线;官方说 “soon”,证明的是未来承诺。不同句子的适用对象不能互相替代。

早报观点

早报判断是,这次最有价值的增量来自已经可试用的产品 Preview;开放权重发布仍未完成。Qwen 先让模型进入 Token Plan 和开发工具,能够快速获得真实工作负载反馈;但在权重、许可证和技术报告出现前,开源生态仍无法复核厂商的核心技术主张。

2.4 万亿参数在传播上很醒目,在工程决策上却暂时信息不足。没有激活参数与架构,基础设施团队无法估算部署成本;没有模型卡与评测细节,研究者无法判断模型表现来自规模、路由、后训练还是服务端配置。把总参数直接翻译成更高能力或更高成本,都会越过现有证据。

“仅次于 Fable 5”应被视作待检验的厂商定位,而不是新闻结论。公开评测集、比较版本、推理预算、污染控制与第三方复现才能提升可信度;同体系账号重复这一句话不会增加证据强度。Preview 的用户反馈可以形成线索,但不能替代这些材料。

对 Qwen 而言,后续开放权重会决定这次预告能否从产品分发事件升级为生态事件。若许可证清晰、部署材料完整、实际权重与 Preview 对齐,社区才能开始独立验证;若 “soon” 长期没有日期与交付物,今天的信号就应继续停留在预览和预告层。

接下来核验什么

第一,看权重交付,而不是继续转述 “soon”。需要逐项核对官方仓库、具体检查点、许可证、文件大小、校验值和发布时间,并确认开放的是 Max-Preview 对应版本、后续稳定版,还是参数规模不同的其他版本。

第二,看技术报告能否解释 2.4 万亿。至少要披露总参数与激活参数、架构、上下文长度、训练和后训练方法、推理配置,以及推荐硬件。只有这些信息出现,部署团队才能从宣传数字转向容量规划。

第三,看能力排序能否被复核。Qwen 若继续使用“仅次于 Fable 5”的表述,应同时公开任务集合、对比模型版本、工具权限、思考预算、评分规则和分项结果。第三方还需要在相同条件下复现,才能判断排序是否稳定。

第四,看三个产品入口是否补齐非 X 证据。Token Plan 已有当天官方代码变更;Qoder 与 QoderWork 仍需要公开模型目录、更新日志或带日期文档,说明适用地区、账户范围、额度和 Preview 的变更策略。

第五,看 Token Plan 与通用 API 的边界。价格页列出模型不等于按量 API 已进入公开模型目录。后续应核对 API 模型标识、计费方式、速率限制、区域可用性与版本固定规则,避免把订阅产品试用扩写成平台全面发布。