DeepSeek V4 为昇腾原生优化,NVIDIA 在华「归零」需要拆开看

DeepSeek 四月把 V4 全栈适配到华为昇腾,是真实转折;但所谓 NVIDIA 在华份额归零、国产首超 55%,和 IDC 的 2025 年数据对不上。真正的约束,是华为一年约 75 万片昇腾 950PR 的产能量级。

2026.08.31 · 4 min

国产大模型“一夜双开源”:比DeepSeek更便宜,正成为新的竞争赛道

8月26日晚,阿里Qwen3.8-Flash-Next与智谱GLM-5.3-Flash几乎同时开源,价格都低于DeepSeek;真正值钱的,是稀疏激活加线性注意力这套架构把“规模=贵”拆了。

2026.08.30 · 3 min

开源大模型的“集体突围”:从单点突破到体系对抗

真正改变格局的不是哪款模型登顶,而是中国已形成能持续批量产出逼近前沿模型、并重新划定全球大模型价格-性能曲线的体系。

2026.08.30 · 6 min

Qwen、GLM、DeepSeek、Kimi 密集开源:这场「集体突围」对做产品的人意味着什么

8 月 Qwen、GLM、DeepSeek、Kimi 密集开源并发布即适配芯片。这轮改变的是供给方式,不是能力上限。模型第一次像水电一样变成用完就能换的公共供给,对做产品的人,最贵的部分从模型本身挪到了调试、治理和信任。

2026.08.29 · 5 min

算力账本,从两分钱那行价算起

两分钱的缓存命中价不是一人公司真正的账本。一个 agent 连跑一个月,输出 token 和高峰计费才是大头,而那点算力钱从来不是公司成立的门槛。

2026.08.29 · 6 min

开源权重"围剿"闭源:DeepSeek V4 与 Qwen3.8-Max 掀翻的定价逻辑

同为一份复杂任务,DeepSeek V4-Flash 单次约 3 美分,Claude Fable 5 要 3 美元出头。便宜一百倍靠的是一套能连续出模型的生产系统,‘开源权重’这个标签只给了你把模型跑起来的自由。

2026.08.29 · 7 min

DeepSeek Harness 把 Agent 拆开了,模型会吃掉哪一层?

DeepSeek Harness 把 Agent 运行时拆成可组合插件,模型会逐渐接管认知编排,权限、审计与执行边界仍将留在外部。

2026.08.15 · 9 min

DeepSeek V4 Flash 把大模型拖进"斩杀线"之后

DeepSeek V4 Flash 参数没变、架构没换,只靠后训练重做就把 Agent 能力拉到逼近 Claude Opus 4.8 的水平,同时价格是后者的百分之一。一周内全球调用量登顶,OpenAI 紧急降价 80%。大模型的竞争标尺正在从 benchmark 跑分变成单位成本的有效输出。

2026.08.06 · 6 min

两套 AI 机器:美国把智能租给世界,中国把智能铺进产业

中美 AI 竞争已经从模型榜单之争,转向两套机器的长期较量:美国的云端智能租赁系统,和中国的产业智能渗透系统。

2026.05.06 · 19 min

DeepSeek V4 技术解读:1.6T 参数、百万 Token 原生上下文与三级推理模式

DeepSeek 于 2026 年 4 月 24 日发布 V4 系列预览版,本文依据官方 API 文档与 Hugging Face 模型卡片,梳理 V4-Pro(1.6T 参数)与 V4-Flash 的规格、架构创新(CSA+HCA 混合注意力、mHC、Muon 优化器)及完整性能基准数据。

2026.04.26 · 4 min