数据时效:2026-08 2.4 万亿参数,约 95B 被激活,一次能读进几十万字,还能扩到上百万。2026 年 8 月 13 日,阿里把 Qwen3.8-2.4T-A95B 的权重放了出来,这是 Qwen 自己的"Max 级"旗舰第一次开放权重。开放权重,就是把训练好的模型文件给你,让你能自己跑,不必只能调别人的 API。
消息出来,我看到大多数人的第一反应是,前沿模型归我了。自己跑、自己微调、不靠任何人,独立开发者的杠杆拉满。
权重开没开放,你能不能跑得动,许不许你拿去卖,是三件不同的事。
这 2.4T 权重大约 4.9TB,官方给的部署形态是一整柜 NVIDIA GB300 NVL72。有人用 1 比特量化把它压到约 397GB,可还是要约 410GB 的内存加显存合计才跑得起来,这个量级更像一个机房,普通工作室电脑撑不起来。里面的"混合专家"(MoE)意思是参数不会每次都全算,只有被激活的约 95B 参与。可就算只算这一小部分,底下的机柜还是摆在那。

放出来的那份是纯文本 checkpoint,没有视觉输入,默认思考模式还关不掉。能看到图、能上 100 万上下文的完整版,得走 API。
Qwen 这次没用宽松的 Apache 2.0,改用一份自定义许可。你要开"模型即服务"或者"AI 工作助手"生意,12 个月营收超过 5000 万美元,就得单独找阿里谈授权。
5000 万美元离一个独立开发者的营收远得很。这条分档线拦下的,是模型路由商、推理市场、AI 工作助手这些会跟阿里自家 API 抢生意的角色。对单打独斗的人,它反而是安全港。许可的名目拦不住一个独立开发者,把他挡在门外的是那 4.9TB 算力。
一个一人公司真正伸手够到的杠杆,在 API 价格上。Qwen3.8-Max 国际价 2 美元进、6 美元出,每百万 token(模型读写文字的基本单位);Kimi K3 3 美元进、15 美元出,缓存命中输入只要 0.30 美元;DeepSeek V4 Flash 旧价 0.14 美元进、0.28 美元出,缓存命中输入一度低到 0.0028 美元。这个价位低得离谱,Claude Fable 5 要 10 美元进、50 美元出,OpenAI 的 GPT-5.6 Sol 也要 4 美元进、20 美元出。按这个价,一家软件公司确实能做到接近零边际成本,多接一单生意,多花的钱趋近于零。
可这个价位是租来的,租金不住在你手上。8 月 17 日,曾经的"价格屠夫"DeepSeek 把缓存命中输入最高涨了大约 12 倍,有独立开发者对媒体说成本至少是原来的 3 倍,用户月费从 40 美元被推过 100 美元,客户流失"肯定会发生"。零边际成本是好梦,脚底下踩的却是"提供方不涨价"这个你控制不了的赌注。它决定你每单的边际成本,却决定不了你的毛利怎么定。真把模型自己跑起来的那一小撮人,我不敢说他们一定长期安全,但至少不把毛利交给别人改价。

开源前沿给一人公司的杠杆,可及的那一格是 API 价格被打到足够低。那是人人拉得动的杠杆。可人人拉得动的杠杆不是壁垒,价格低到谁都买得起,也把定价权留在了别人手里。
所以看到"2.4T 开源了",别急着问哪家更强。该问的是你能用到的到底是哪一级。多数人最后能用的,无非是那个随时会变的 token 价;少数把模型自己跑起来、又跑得起、又有合规底气的人,走的是另一条路。后一条考验的是你能不能自己把自己托住,技术占的分量没那么大。