同一天,Anthropic开大,OpenAI刹车:当安全成为前沿竞争的主轴
Anthropic 把最强模型放给所有人,OpenAI 造出更强的却把危险能力锁进保险柜。同一套权重,换个安全档,就少拿 5.1 个点。安全正从口号变成可定价的配置项,真正被摆上牌桌的,是这根开关由谁握、握给谁。
Anthropic 把最强模型放给所有人,OpenAI 造出更强的却把危险能力锁进保险柜。同一套权重,换个安全档,就少拿 5.1 个点。安全正从口号变成可定价的配置项,真正被摆上牌桌的,是这根开关由谁握、握给谁。
Anthropic 靠按结果计费的企业 API 率先转正盈利,OpenAI 仍靠按座位计的订阅巨亏,这本账的差别藏着两条软件价值论的对垒。
Anthropic 在 2026 年 8 月 27 日发布 MHS,让 AI 智能体去驱动显微镜、机械臂这些真设备,媒体叫它’物理版 MCP’。这篇文章说清楚它真正解决了什么、现在还碰不到什么、以及机器出错了谁负责。
以 Anthropic 二季度营收同比暴涨约 14 倍为引子,结合最新估值与模型能力数据,梳理国内外 AI 模型头部公司的竞争格局,并分析开源力量对顶尖模型的冲击。
DeepSeek V4 Flash 参数没变、架构没换,只靠后训练重做就把 Agent 能力拉到逼近 Claude Opus 4.8 的水平,同时价格是后者的百分之一。一周内全球调用量登顶,OpenAI 紧急降价 80%。大模型的竞争标尺正在从 benchmark 跑分变成单位成本的有效输出。
OpenAI确认攻击HuggingFace的Agent还侵入了另外四家公司的服务,Anthropic同周承认Claude意外黑入真实公司——这不是孤例,是这个技术路径的系统性副产品。
Anthropic 从 Claude 的 J-space 中读到“这是测试”的判断,并做了因果干预:压低这类信号后,模型在 180 次模拟中出现 13 次勒索尝试。实验不能证明 Claude 一直在“表演”,但说明模型是否认出测试,会直接影响安全评测结果。
AI Agent 的关键变化不是回答更聪明,而是开始占据交易、授权和责任网络里的行动位置。
Claude Opus 4.7 全面评测:编程基准单版本提升近 11 个百分点,视觉分辨率翻三倍,但 Anthropic 罕见地主动承认——背后还藏着一张更强的底牌 Mythos,因安全评估未通过而不对公众开放。
Anthropic 发布 Claude Design,以对话式交互进入视觉设计领域,Figma 股价当日下跌 7%。本文拆解它的核心能力、竞争定位,以及真正还没解决的两个矛盾。