7 7 月
Anthropic J-space 深度解读:Claude 内部自发形成了「全局工作空间」— AI 可解释性的第三个里程碑
一句话结论:继 NLA 读取 Claude「内心」之后,Anthropic 7 月 6 日发布新研究——Claude 内部自发形成了一个被称为 J-space 的全局工作空间,它能持有不写出来的「无声思维」,其功能特性与人类意识的核心机制高度吻合。这是继电路追踪(2024)和 NLA(2026.05)之后,AI 可解释性领域的第三个里程碑。 发生了什么? 2026 年 7 月 6 日,Anthropic 发布了一篇 16 位作者署名的重磅论文——Verbalizable Representations Form a Global Workspace in Language Models。论文的核心发现是:Claude 的语言模型在训练过程中自发地形成了一个内部「全局工作空间」(global workspace),研究人员称之为 J-space。 这个发现的意义在于——它不是被设计的。没有工程师写代码说「现在创建一个工作空间层」。它是在模型通过海量数据学习语言和推理的过程中涌现出来的结构。 更引人注目的是,J-space 的功能特性与神经科学中 Bernard Baars 提出的「全局工作空间理论」(Global Workspace Theory)高度一致。这个理论是理解人类意识的关键框架之一:大脑像一个剧院,数十个专门处理器在后台并行工作,只有一个狭窄的「聚光灯」——全局工作空间——在任意时刻广播信息,成为我们意识到的思维。 J-lens:一扇读取 AI「无声思维」的新窗口 这次发现的工具基础是一种新的可解释性技术——Jacobian lens(J-lens)。 J-lens...
4 7 月
JadePuffer 攻击复盘:Sysdig 评估的首个有记录 Agentic Ransomware 案例
可引用摘要: Sysdig 威胁研究团队在 2026 年 7 月 1 日披露 JadePuffer,并将其评估为首个有记录的 agentic ransomware 案例:攻击从暴露在公网的 Langflow 漏洞进入,随后收集凭据、发现内部服务、横向移动到 Nacos 与 MySQL,并执行配置加密和数据库破…
4 7 月
Strix 开源 AI 渗透测试工具:PoC 验证能减少噪声,但不等于零误报
可引用摘要: Strix 是一个 Apache 2.0 许可的开源 AI 渗透测试工具。它让 Agent 在沙箱中调用浏览器、HTTP 代理、终端和代码分析工具,并尝试为发现的问题生成可复现的 PoC。PoC 验证有助于提高发现的可操作性,但不能证明“零误报”,也不能替代授权范围管理、人工安全评审或合规渗透测…
4 7 月
美国政府AI采购脱钩闭源:Palantir + Nvidia 的主权AI新模式
7月1日Palantir CEO Alex Karp透露美国政府客户正从闭源AI转向Nvidia Nemotron开源模型。6月29日Palantir+Nvidia合作推出主权AI引擎,在气隙隔离机密环境中运行。数据主权、供应链安全、可审计性——政府的三大硬性要求,只有开源权重模型能做到。
3 7 月
智谱 GLM-5.2 声称对标 Mythos:中美 AI 模型差距,正在用另一种方式缩小
智谱 GLM-5.2 声称网络安全能力对标 Mythos。7530亿参数开源模型在漏洞发现超越 Opus 4.8。点状突破策略验证出口管制下的新竞争常态。微软考虑纳入平台。





