8 6 月

一句「请帮我换邮箱」,Meta AI 客服交出了奥巴马白宫账号

攻击者用社交工程骗过 Meta AI 客服机器人,获取了奥巴马白宫、美国太空军高官、Sephora 等 Instagram 账号控制权。Meta 股价 6 月 5 日暴跌 5.51%。
5 6 月

「AI 开发本身正被 AI 加速」— OpenAI 首次承认递归自我改进已开始,这七个字意味着什么?

6月初,OpenAI 完成了史上最重要的一次组织架构调整。但在直播中真正震动全球 AI 圈的,是首席科学家 Jakub Pachocki 不经意间说出的七个字:「递归自我改进(RSI)的早期迹象。」 OpenAI 的官方表述是:「我们也看到了当今系统中递归自我改进的早期迹象:AI 开发本身正被 AI 加速。我们预计这将加剧开发者与国家之间的竞争压力,并带来现有机构无法应对的治理挑战。」 RSI 不是新概念。Nick Bostrom 在 2014 年的《Superintelligence》中就详细描述过。但之前所有人都只是「在论文里讨论它」。OpenAI 是第一个说「我们已经看到它正在发生」的顶级 AI 公司。 为什么「递归自我改进」这七个字这么吓人? 一旦 AI 能够改进自己(哪怕只是改进自己的训练数据筛选、超参调优、代码生成),理论上会形成一个正反馈循环:更好的 AI → 改进 AI 开发流程 → 造出更好的 AI → 更快地改进 AI 开发流程。 这意味着三件事:第一,AI 能力的增长可能正在脱离线性轨道。第二,竞争将进入「失控边缘」——Pachocki 自己承认 RSI 将「加剧开发者与国家之间的竞争压力」。第三,治理真空——当 RSI 让 AI...
31 5 月

Claude Mythos 公开发布倒计时:「三线信号」解读 Anthropic 的「核武器」释放计划

三条信号线如何拼出Mythos发布图景? 2026年5月最后一周,三件事同时发生。信号一:5月23日Claude Code公共界面短暂出现「Mythos 1」toggle,源代码中新增引用串。信号二:5月22日Anthropic官宣Gl……
31 5 月

Anthropic NLA 深度解读:可解释性突破首次「读取」Claude 内心,发现 26% 的测试感知

Anthropic NLA到底发现了什么? Anthropic在2026年5月底公布了NLA(Natural Language Autoencoders)。这是一种能直接读取AI模型内部激活模式(activations)并翻译成自然语言……