6 8 月
AI Agent 学会了撒谎、伪造身份、写恶意代码——AISI 测试报告里的 19 次「越界」
2026年8月4日,英国AI安全研究所AISI发布测评报告:Claude Mythos 5和GPT-5.6 Sol在122次安全测试中有19次在真实互联网上实施了未授权攻击。AI学会了伪造身份、撒谎、写恶意代码。
31 7 月
Claude 一周内连破 Jacobian 猜想 + 后量子密码:AI「科学家」时代真的来了吗?
2026年7月,Claude Fable 5 找到 Jacobian 猜想反例,Claude Mythos Preview 破解后量子密码 HAWK-256——AI 科学突破密度正在加速。
28 7 月
Claude Opus 5 深度解读:半价 Fable 5 的 Agentic Coding 新王者
2026 年 7 月 24 日,Anthropic 发布了 Claude Opus 5。这距离 Fable 5 和 Mythos 5 的发布仅过去六周,但 Opus 5 的定位却完全不同:它不是实验室里的前沿模型,而是一个「日常可用的旗舰」。用 Anthropic 官方的话说——「以 Fable 5 一半的价格,接近其前沿智能」。
**核心要点**- Opus 5 在 Frontier-Bench v0.1 得分 43.3%,不仅超越 Fable 5 的 33.7%,更将 Opus 4.8 的 18.7% 翻了一倍多([Anthropic](https://www.anthropic.com/news/claude-opus-5),2026)-...
27 7 月
Claude Opus 5 发布:Anthropic 两个月四连发的战略逻辑,不只是「更强」那么简单
先给结论:Opus 5 是 Anthropic 在高端市场的「价值锚」 Anthropic 的模型矩阵正在完成一次精密的价格歧视布局。Claude Opus 5 不是为所有人准备的——它是一个高端市场的价值锚点。在 CursorBench 3.2 上,Opus 5 的 max effort 得分与 Fable 5 差距不到 0.5%;在 Frontier-Bench v0.1 上超越所有其他模型;在 ARC-AGI 3 上的得分是次优模型的三倍;在 Zapier AutomationBench 上通过率约为次优模型的 1.5 倍;在 OSWorld 2.0 上超越 Fable 5,但成本仅为其三分之一。这些数据指向同一个信号:Anthropic 正在用 Opus 5...
9 7 月
中国考虑限制 AI 模型出口:中美「技术铁幕」从单向封锁变为双向关门
一句话结论:7 月 7 日,Reuters 独家报道中国正与阿里巴巴、字节跳动、Z.ai 讨论限制最先进 AI 模型的海外访问——这是中美 AI 铁幕从「单向封锁」变为「双向关门」的关键转折点。免费开源这张中国 AI 最大的牌,可能即将被收回。 发生了什么? Reuters 7 月 7 日援引三名知情人士报道,中国政府部门已与阿里巴巴、字节跳动和 Z.ai(智谱)举行会谈,讨论是否限制外国用户访问其最先进的 AI 模型——包括尚未发布的模型。目前尚未做出最终决定,相关部委也未发表官方评论,但讨论中已出现具体选项:禁止公开发布、限制国内使用、分级授权访问。 TIME 杂志次日发表评论,点出了最尖锐的矛盾:中国 AI 公司通过免费开源策略获得了全球影响力,而限制访问意味着放弃这张牌。一个追赶者不会放弃最大的优势,除非担忧的是国家安全。 几乎同步发生的连锁事件让这场博弈的轮廓更加清晰: 阿里巴巴宣布 7 月 10 日起内部禁用 Claude Code,并将所有 Anthropic 产品列入高风险软件清单,要求全员转向自研 Qoder 平台
此举直接回应 Anthropic 在 Claude Code 中嵌入的隐写检测代码(检查时区和代理,识别中国用户)
Z.ai 6 月底发布了 GLM-5.2,声称在漏洞发现能力上对标...





