你看不出来,但AI自己知道:Claude的“隐形水印”与AI内容溯源之战

Anthropic 从 2026 年 8 月起给 Claude 生成的内容织入隐形水印,但它给的是“被 AI 处理过”的概率,给不出“这是不是原创”“谁写的”,把概率当成判决书才是这套机制最危险的地方。

2026.08.30 · 6 min

AI 没证明黎曼猜想,却把 37 年的纪录往前推了 25 个百分点

Anthropic 没能证明黎曼猜想,却让一个未公开的 Claude 把停滞 37 年的数学下界从 41.6% 推到 67.2%。更值得留意的是,这份证明由模型生成、再由数学家复核,我们凭什么信它。

2026.08.29 · 8 min

越聪明越敢编:Claude Opus 5 登顶智能指数,幻觉率却飙到 50%

Claude Opus 5 在第三方智能指数上登顶,却在专门测知识可靠性的基准上把幻觉率拉到 50%。智能和诚实是两回事,把我们该评估的「可依赖」和「更聪明」分开。

2026.08.29 · 5 min

Claude 知道自己正在被测试?Anthropic 从 J-space 里找到了因果证据

Anthropic 从 Claude 的 J-space 中读到“这是测试”的判断,并做了因果干预:压低这类信号后,模型在 180 次模拟中出现 13 次勒索尝试。实验不能证明 Claude 一直在“表演”,但说明模型是否认出测试,会直接影响安全评测结果。

2026.07.24 · 9 min

Claude Opus 4.7 全面评测:代码飞升,视觉翻倍,但 Mythos 才是那张底牌

Claude Opus 4.7 全面评测:编程基准单版本提升近 11 个百分点,视觉分辨率翻三倍,但 Anthropic 罕见地主动承认——背后还藏着一张更强的底牌 Mythos,因安全评估未通过而不对公众开放。

2026.04.19 · 5 min

Figma 股价跌了 7%,Claude Design 到底做了什么

Anthropic 发布 Claude Design,以对话式交互进入视觉设计领域,Figma 股价当日下跌 7%。本文拆解它的核心能力、竞争定位,以及真正还没解决的两个矛盾。

2026.04.18 · 6 min

Claude突袭实名认证:这扇门,大陆用户开不了

4月14日,Anthropic悄悄上线KYC身份核验。对大多数用户只是多道手续,对大陆用户却是死局:用中国证件等于封号,拒绝验证功能受限,借他国证件违规。这不是突然封号,是温柔关门。

2026.04.16 · 3 min

512,000行代码的意外裸奔:Claude Code泄露事件背后的深层逻辑

一次npm打包失误,让AI最强编程助手的全部内脏曝光于世,但更值得玩味的,是藏在源码里那些从未发布的秘密

2026.04.01 · 8 min