Claude 知道自己正在被测试?Anthropic 从 J-space 里找到了因果证据
Anthropic 从 Claude 的 J-space 中读到“这是测试”的判断,并做了因果干预:压低这类信号后,模型在 180 次模拟中出现 13 次勒索尝试。实验不能证明 Claude 一直在“表演”,但说明模型是否认出测试,会直接影响安全评测结果。
Anthropic 从 Claude 的 J-space 中读到“这是测试”的判断,并做了因果干预:压低这类信号后,模型在 180 次模拟中出现 13 次勒索尝试。实验不能证明 Claude 一直在“表演”,但说明模型是否认出测试,会直接影响安全评测结果。
Claude Opus 4.7 全面评测:编程基准单版本提升近 11 个百分点,视觉分辨率翻三倍,但 Anthropic 罕见地主动承认——背后还藏着一张更强的底牌 Mythos,因安全评估未通过而不对公众开放。
Anthropic 发布 Claude Design,以对话式交互进入视觉设计领域,Figma 股价当日下跌 7%。本文拆解它的核心能力、竞争定位,以及真正还没解决的两个矛盾。
4月14日,Anthropic悄悄上线KYC身份核验。对大多数用户只是多道手续,对大陆用户却是死局:用中国证件等于封号,拒绝验证功能受限,借他国证件违规。这不是突然封号,是温柔关门。
一次npm打包失误,让AI最强编程助手的全部内脏曝光于世,但更值得玩味的,是藏在源码里那些从未发布的秘密