Qwen3.8 官宣里最值得读的,不是 2.4T
今天下午四点多,通义千问的官方 X 账号发了一条帖子,一共三句话,我来回读了好几遍。
第一句,Qwen3.8 即将发布,很快开源权重。第二句,2.4T 参数,我们相信它是目前最强大的模型之一,仅次于 Fable 5。第三句,不用等,Qwen3.8-Max-Preview 已经上线阿里自家的 Token Plan、Qoder 和 QoderWork。
好家伙。三句话,每句都够别的号写一篇通稿。2.4T 参数的巨兽,官方亲口把自己排到全球第二,还承诺开源。今晚的中文 AI 圈大概率全是这三个关键词。
但我反复读这条帖子,越读越觉得,真正的信息不在这三个关键词里,在三个不起眼的细节里。「很快」这两个字,「仅次于」这三个字,还有 Preview 首发的位置。这篇我想把这三个细节抠开给你看,因为它们拼在一起,讲的是另一个故事,一个关于「开源」这个词正在变味的故事。
先抠第一个细节,「很快开源权重」。
注意时态。此时此刻,权重并没有放出来。HuggingFace 上没有,ModelScope 上没有,GitHub 上也没有。你现在能摸到的只有 Qwen3.8-Max-Preview,一个跑在阿里自家服务器上的预览版。开源在这条官宣里是将来时,是一张期票。
期票不是不能收,但收之前得看看出票方最近的信用记录。
这就要讲到 Qwen 今年的路线摇摆了,这段历史挺精彩的,值得从头捋一遍。
今年 4 月,Qwen3.6-Plus 发布,1M 上下文,Apache 2.0 协议,权重随便下,商用不要钱。那时候的 Qwen 还是全球开源模型的头牌,社区里提起阿里都是竖大拇指的。
5 月中旬,画风突变。Qwen3.7 系列官宣,Max 和 Plus 两个旗舰,全部闭源,只给 API。跑分确实漂亮,数学推理和长文检索都压着 Claude Opus 4.6 打,但社区想要的那份权重文件,没有。有人复盘这段时用了一个很扎心的说法,年初还是世界开源领袖,到 7 月,最强的模型已经全部只在云上。

更早一点,3 月,Qwen 核心团队经历了一波动荡。技术负责人林俊旸离职,告别帖就一句,me stepping down, bye my beloved qwen。后训练负责人和代码研究负责人也在同期离开。我看到那条告别帖的时候还感慨过,一个模型系列做成世界第一梯队,做的人却走了。
所以两个月前,如果你问任何一个圈内人,Qwen 的旗舰还会开源吗,答案大概率是不会了。闭源换商业化,这条路 OpenAI 走过,Anthropic 走过,轮到阿里走,逻辑上顺理成章。
然后 7 月 16 号,也就是三天前,月之暗面把 Kimi K3 的权重直接拍在了桌上。2.8T 参数,开放权重,发布几个小时后登顶前端代码竞技场,对上我这种天天用的 Fable 5 都能打出七成六的胜率。Artificial Analysis 隔天发榜,八天之内四款前沿模型发布,Kimi K3 冲进综合榜前三。前沿榜的前三名里第一次出现了开放权重的模型。
同一周还有个背景音,Mira Murati 的 Thinking Machines 把 975B 的 Inkling 完整权重放了出来,而 Google 的 Gemini 3.5 Pro 又跳票了,卡在编码能力上不达预期。
把时间线摆在一起看就很有意思了。5 月旗舰闭源,7 月 16 号被开源的 Kimi K3 抢走头条和榜单,7 月 19 号宣布新旗舰将开源。这个回摆的弧线,怎么看都不像深思熟虑的战略定力,更像被友商按着头调整了方向盘。
我不是说这有什么不对。商业公司看牌桌下注,天经地义。Kimi K3 用开放权重打出了声量、拉满了开发者好感,还顺手证明了开源和第一梯队性能可以兼得,那阿里跟牌太正常了。我想提醒的只是一件事,当「开源」变成一张跟牌用的筹码,它的兑现时间和兑现程度就都成了变量。「很快」可以是下周,也可以是一个季度,权重可以是完整的 2.4T,也可以是裁剪过的小尺寸版本。期票在兑付之前,都只是纸。
再抠第二个细节,「仅次于 Fable 5」。
这个说法有点子牛逼的地方在于,它同时干了两件事。一是把 GPT-5.6 Sol、Gemini、Grok 4.5 全都排到了自己身后,二是通过认领第二名的位置,反而显得特别诚恳。你看,我们没吹自己第一,我们承认打不过 Fable 5,所以剩下的部分你可以信了吧。
怎么说呢,这套话术我的警惕心是拉满的。原因很简单,现在能验证这句话的人不存在。权重没放,第三方跑不了独立评测,你能接触到的只有 Preview 版,而 Preview 和正式版之间的水位差,行业里已经交过太多次学费了。厂商完全可以给预览版拉满推理预算和采样次数,把体感做上去,等正式版为了成本收一收,跑分和体验再一起滑下来。我干的活就是给模型搭运行环境做评测的,这种「发布前的模型」和「上线后的模型」判若两模的事,一线见得不少。
所以「仅次于 Fable 5」这五个字,现阶段的准确翻译是,我们内部评测认为仅次于 Fable 5。信不信,等权重放出来,等 LMArena 和 Artificial Analysis 的独立数据出来,再决定不迟。反正官宣发出来这几个小时,各家评测机构应该已经在排队了。
第三个细节最有意思,Preview 首发的位置。
不是 HuggingFace,不是开放 API 平台,是 Token Plan、Qoder、QoderWork。前者是阿里的订阅计划,看一眼定价,标准席每月 20 美元,Pro 席 75 美元,Max 席 200 美元,按 Credits 计量,个人版还有 5 小时和 7 天双滑动窗口的限额。后两个是阿里的 AI 编码工具和协作平台。

这个配方眼熟吗。月费订阅,Credits 计量,滑动窗口限额,自家编码工具首发新模型。把名字遮住,你分不清这说的是阿里还是 Anthropic 的 Claude Max,还是 OpenAI 的 ChatGPT 订阅。全球几家大厂在 2026 年的夏天收敛到了同一个商业模式上,新旗舰不再是挂在 API 上任人取用的公共资源,而是先塞进自家订阅体系当独占内容,像游戏主机的首发独占大作一样。
Token Plan 的文档里已经老老实实列出了 qwen3.8-max-preview 这个模型名,跟 qwen3.7-max、deepseek-v4-pro 并排放着。文档还写了兼容 Claude Code、Cursor 这些第三方编码工具。翻译一下就是,欢迎把你的编码工作流迁到我的订阅上来,模型管够。
看明白了吗。「即将开源」负责上头条、赚口碑、稳住开发者社区,「Preview 独占」负责在权重放出来之前的这个窗口期,把热度全部导流进自家订阅。开源公告本身成了获客漏斗的第一层。这个设计说实话挺精巧的,我甚至有点欣赏。只是我们做开发的,得知道自己在漏斗的哪一层。
聊到这里,可以回答那个更实际的问题了。2.4T 参数开源,对屏幕前的你,到底有多大意义。
先泼一盆冷水,本地部署这条路,对绝大多数人是不存在的。2.4T 参数,就算按 FP8 存也是两个多 TB 的权重文件,量化到 4bit 还得一个多 TB,这不是加两根内存条能解决的事,是得有一个推理集群的事。Kimi K3 的 2.8T 开源三天了,你身边有几个人真在本地跑它,答案大概是零。这类超大杯开源模型,权重下载按钮对个人开发者更像一个行为艺术按钮。
那开源就没用了吗,恰恰相反,用处很大,只是不在你的硬盘上。
一是价格锚定。权重公开的模型,任何云厂商都能托管,SiliconFlow、Together、各家 GPU 云会立刻挂出来竞价,API 价格会被打到远低于闭源旗舰的水平。Qwen3.7-Max 闭源,第三方网关的价格是输入 1.25 美元输出 3.75 美元每百万 token,等 3.8 权重真放出来,同能力的托管价格大概率会明显低于这个数。你不用跑权重,但你会享受到权重公开带来的市场价。
二是蒸馏和微调的原料。2.4T 的教师模型权重在手,社区和小厂就能往小尺寸学生模型里灌能力,你半年后用到的某个 30B 的高性价比模型,血统里可能就有它。这是开源大模型真正的生态价值,参数不是拿来跑的,是拿来榨的。
三是谈判筹码。哪怕你司一行 Qwen 的代码都不用,采购闭源模型的时候,桌上摆着一个「随时可以自托管的前沿开源替代」,报价单都会好看一些。今年上半年不少美国企业砸掉预算表全面转向 DeepSeek,逻辑就是这个。
所以我的建议很朴素。今晚各种「国产之光 2.4T 碾压」和「阿里画饼权重在哪」的帖子都会出来,两边都不用急着站。想尝鲜的,Preview 就在那儿,有 Qoder 或者 Token Plan 入口的可以去摸摸真实水平,重点试试长程任务和代码,看跟官宣的口气对不对得上。更稳妥的做法是设个提醒,等权重真的落到 HuggingFace,等独立评测出分,再更新判断。「很快」到底是多快,就是接下来最值得盯的那个指标,它比任何跑分都诚实。
今天这事让我想起航海时代的老把戏,远处的船挂出友好的旗子,说我们马上共享航图。旗子可能是真的,航图也可能真的会给,但老水手的习惯是,旗子归旗子,眼睛还是盯着对方的船头。
权重落地那天,我再来跟你汇报它到底有多强。
(正文提到的所有来源,官宣原帖、定价文档、Qwen 路线复盘、竞品发布,链接都在文中,感兴趣可以顺着去核对原始信息。)