国产大模型“一夜双开源”:比DeepSeek更便宜,正成为新的竞争赛道

8月26日晚,阿里Qwen3.8-Flash-Next与智谱GLM-5.3-Flash几乎同时开源,价格都低于DeepSeek;真正值钱的,是稀疏激活加线性注意力这套架构把“规模=贵”拆了。

2026.08.30 · 3 min

国产大模型“一夜双开源”:比DeepSeek更便宜,正成为新的竞争赛道

8月26日晚,Qwen 与智谱几乎同时开源,把 API 输入价压到 1 元与 0.8 元;这场价格战真正新的,是模型把 176B 参数做成只有 6B 被计算、51B 靠查表,用存储换计算把便宜做成工程事实。

2026.08.30 · 3 min

Qwen、GLM、DeepSeek、Kimi 密集开源:这场「集体突围」对做产品的人意味着什么

8 月 Qwen、GLM、DeepSeek、Kimi 密集开源并发布即适配芯片。这轮改变的是供给方式,不是能力上限。模型第一次像水电一样变成用完就能换的公共供给,对做产品的人,最贵的部分从模型本身挪到了调试、治理和信任。

2026.08.29 · 5 min

越聪明越敢编:Claude Opus 5 登顶智能指数,幻觉率却飙到 50%

Claude Opus 5 在第三方智能指数上登顶,却在专门测知识可靠性的基准上把幻觉率拉到 50%。智能和诚实是两回事,把我们该评估的「可依赖」和「更聪明」分开。

2026.08.29 · 5 min

开源权重"围剿"闭源:DeepSeek V4 与 Qwen3.8-Max 掀翻的定价逻辑

同为一份复杂任务,DeepSeek V4-Flash 单次约 3 美分,Claude Fable 5 要 3 美元出头。便宜一百倍靠的是一套能连续出模型的生产系统,‘开源权重’这个标签只给了你把模型跑起来的自由。

2026.08.29 · 7 min

Anthropic 营收暴涨十四倍,AI 头部之争走到哪一步了?

以 Anthropic 二季度营收同比暴涨约 14 倍为引子,结合最新估值与模型能力数据,梳理国内外 AI 模型头部公司的竞争格局,并分析开源力量对顶尖模型的冲击。

2026.08.16 · 6 min

GPT-6 的 10 万亿参数上了热搜,OpenAI 官方却在踩刹车

GPT-6 上热搜的两个数字,10 万亿参数和 8 月发布,都来自一条没被证实的爆料;OpenAI 官方真正确认的,是 Astra 第一次可能触及自己安全框架的最高一级,并为此踩了刹车。

2026.08.10 · 5 min

DeepSeek V4 Flash 把大模型拖进"斩杀线"之后

DeepSeek V4 Flash 参数没变、架构没换,只靠后训练重做就把 Agent 能力拉到逼近 Claude Opus 4.8 的水平,同时价格是后者的百分之一。一周内全球调用量登顶,OpenAI 紧急降价 80%。大模型的竞争标尺正在从 benchmark 跑分变成单位成本的有效输出。

2026.08.06 · 6 min

两套 AI 机器:美国把智能租给世界,中国把智能铺进产业

中美 AI 竞争已经从模型榜单之争,转向两套机器的长期较量:美国的云端智能租赁系统,和中国的产业智能渗透系统。

2026.05.06 · 19 min

DeepSeek V4 技术解读:1.6T 参数、百万 Token 原生上下文与三级推理模式

DeepSeek 于 2026 年 4 月 24 日发布 V4 系列预览版,本文依据官方 API 文档与 Hugging Face 模型卡片,梳理 V4-Pro(1.6T 参数)与 V4-Flash 的规格、架构创新(CSA+HCA 混合注意力、mHC、Muon 优化器)及完整性能基准数据。

2026.04.26 · 4 min