国产大模型“一夜双开源”:比DeepSeek更便宜,正成为新的竞争赛道
8月26日晚,阿里Qwen3.8-Flash-Next与智谱GLM-5.3-Flash几乎同时开源,价格都低于DeepSeek;真正值钱的,是稀疏激活加线性注意力这套架构把“规模=贵”拆了。
8月26日晚,阿里Qwen3.8-Flash-Next与智谱GLM-5.3-Flash几乎同时开源,价格都低于DeepSeek;真正值钱的,是稀疏激活加线性注意力这套架构把“规模=贵”拆了。
8月26日晚,Qwen 与智谱几乎同时开源,把 API 输入价压到 1 元与 0.8 元;这场价格战真正新的,是模型把 176B 参数做成只有 6B 被计算、51B 靠查表,用存储换计算把便宜做成工程事实。
8 月 Qwen、GLM、DeepSeek、Kimi 密集开源并发布即适配芯片。这轮改变的是供给方式,不是能力上限。模型第一次像水电一样变成用完就能换的公共供给,对做产品的人,最贵的部分从模型本身挪到了调试、治理和信任。
Claude Opus 5 在第三方智能指数上登顶,却在专门测知识可靠性的基准上把幻觉率拉到 50%。智能和诚实是两回事,把我们该评估的「可依赖」和「更聪明」分开。
同为一份复杂任务,DeepSeek V4-Flash 单次约 3 美分,Claude Fable 5 要 3 美元出头。便宜一百倍靠的是一套能连续出模型的生产系统,‘开源权重’这个标签只给了你把模型跑起来的自由。
以 Anthropic 二季度营收同比暴涨约 14 倍为引子,结合最新估值与模型能力数据,梳理国内外 AI 模型头部公司的竞争格局,并分析开源力量对顶尖模型的冲击。
GPT-6 上热搜的两个数字,10 万亿参数和 8 月发布,都来自一条没被证实的爆料;OpenAI 官方真正确认的,是 Astra 第一次可能触及自己安全框架的最高一级,并为此踩了刹车。
DeepSeek V4 Flash 参数没变、架构没换,只靠后训练重做就把 Agent 能力拉到逼近 Claude Opus 4.8 的水平,同时价格是后者的百分之一。一周内全球调用量登顶,OpenAI 紧急降价 80%。大模型的竞争标尺正在从 benchmark 跑分变成单位成本的有效输出。
中美 AI 竞争已经从模型榜单之争,转向两套机器的长期较量:美国的云端智能租赁系统,和中国的产业智能渗透系统。
DeepSeek 于 2026 年 4 月 24 日发布 V4 系列预览版,本文依据官方 API 文档与 Hugging Face 模型卡片,梳理 V4-Pro(1.6T 参数)与 V4-Flash 的规格、架构创新(CSA+HCA 混合注意力、mHC、Muon 优化器)及完整性能基准数据。