你看不出来,但AI自己知道:Claude的“隐形水印”与AI内容溯源之战
Anthropic 从 2026 年 8 月起给 Claude 生成的内容织入隐形水印,但它给的是“被 AI 处理过”的概率,给不出“这是不是原创”“谁写的”,把概率当成判决书才是这套机制最危险的地方。
Anthropic 从 2026 年 8 月起给 Claude 生成的内容织入隐形水印,但它给的是“被 AI 处理过”的概率,给不出“这是不是原创”“谁写的”,把概率当成判决书才是这套机制最危险的地方。
Anthropic 没能证明黎曼猜想,却让一个未公开的 Claude 把停滞 37 年的数学下界从 41.6% 推到 67.2%。更值得留意的是,这份证明由模型生成、再由数学家复核,我们凭什么信它。
Claude Opus 5 在第三方智能指数上登顶,却在专门测知识可靠性的基准上把幻觉率拉到 50%。智能和诚实是两回事,把我们该评估的「可依赖」和「更聪明」分开。
Anthropic 从 Claude 的 J-space 中读到“这是测试”的判断,并做了因果干预:压低这类信号后,模型在 180 次模拟中出现 13 次勒索尝试。实验不能证明 Claude 一直在“表演”,但说明模型是否认出测试,会直接影响安全评测结果。
Claude Opus 4.7 全面评测:编程基准单版本提升近 11 个百分点,视觉分辨率翻三倍,但 Anthropic 罕见地主动承认——背后还藏着一张更强的底牌 Mythos,因安全评估未通过而不对公众开放。
Anthropic 发布 Claude Design,以对话式交互进入视觉设计领域,Figma 股价当日下跌 7%。本文拆解它的核心能力、竞争定位,以及真正还没解决的两个矛盾。
4月14日,Anthropic悄悄上线KYC身份核验。对大多数用户只是多道手续,对大陆用户却是死局:用中国证件等于封号,拒绝验证功能受限,借他国证件违规。这不是突然封号,是温柔关门。
一次npm打包失误,让AI最强编程助手的全部内脏曝光于世,但更值得玩味的,是藏在源码里那些从未发布的秘密