DeepSeek V4 为昇腾原生优化,NVIDIA 在华「归零」需要拆开看
DeepSeek 四月把 V4 全栈适配到华为昇腾,是真实转折;但所谓 NVIDIA 在华份额归零、国产首超 55%,和 IDC 的 2025 年数据对不上。真正的约束,是华为一年约 75 万片昇腾 950PR 的产能量级。
DeepSeek 四月把 V4 全栈适配到华为昇腾,是真实转折;但所谓 NVIDIA 在华份额归零、国产首超 55%,和 IDC 的 2025 年数据对不上。真正的约束,是华为一年约 75 万片昇腾 950PR 的产能量级。
8月26日晚,阿里Qwen3.8-Flash-Next与智谱GLM-5.3-Flash几乎同时开源,价格都低于DeepSeek;真正值钱的,是稀疏激活加线性注意力这套架构把“规模=贵”拆了。
真正改变格局的不是哪款模型登顶,而是中国已形成能持续批量产出逼近前沿模型、并重新划定全球大模型价格-性能曲线的体系。
8 月 Qwen、GLM、DeepSeek、Kimi 密集开源并发布即适配芯片。这轮改变的是供给方式,不是能力上限。模型第一次像水电一样变成用完就能换的公共供给,对做产品的人,最贵的部分从模型本身挪到了调试、治理和信任。
两分钱的缓存命中价不是一人公司真正的账本。一个 agent 连跑一个月,输出 token 和高峰计费才是大头,而那点算力钱从来不是公司成立的门槛。
同为一份复杂任务,DeepSeek V4-Flash 单次约 3 美分,Claude Fable 5 要 3 美元出头。便宜一百倍靠的是一套能连续出模型的生产系统,‘开源权重’这个标签只给了你把模型跑起来的自由。
DeepSeek Harness 把 Agent 运行时拆成可组合插件,模型会逐渐接管认知编排,权限、审计与执行边界仍将留在外部。
DeepSeek V4 Flash 参数没变、架构没换,只靠后训练重做就把 Agent 能力拉到逼近 Claude Opus 4.8 的水平,同时价格是后者的百分之一。一周内全球调用量登顶,OpenAI 紧急降价 80%。大模型的竞争标尺正在从 benchmark 跑分变成单位成本的有效输出。
中美 AI 竞争已经从模型榜单之争,转向两套机器的长期较量:美国的云端智能租赁系统,和中国的产业智能渗透系统。
DeepSeek 于 2026 年 4 月 24 日发布 V4 系列预览版,本文依据官方 API 文档与 Hugging Face 模型卡片,梳理 V4-Pro(1.6T 参数)与 V4-Flash 的规格、架构创新(CSA+HCA 混合注意力、mHC、Muon 优化器)及完整性能基准数据。