
26
6 月
Claude Sonnet 4.5 发布:SWE-bench 登顶、能连肝 30 小时,Agent SDK 也开源了

Anthropic 选了一个很妙的时间点。6 月 25 日,在 OpenAI DevDay 倒计时七天的时候,Claude Sonnet 4.5 正式发布。三个核心动作:SWE-bench Verified 登顶业界第一、一次会话能连续自主工作超过 30 小时、以及——把内部用来搭建 Claude Code 的底层基础设施 Claude Agent SDK 开源了。
30 小时不间断工作:Agent 的「续航焦虑」被解决了
Claude Opus 4 和 OpenAI Codex 最多连续工作约 7 小时。Sonnet 4.5 直接推到了 30+ 小时。你可以下班前给 Claude 派个活,第二天早上来验收。 配套的检查点功能能随时保存进度,做错了可以一键回退。
Agent SDK 开源:Anthropic 的「Android 时刻」
Claude Agent SDK 是 Anthropic 内部用来搭建 Claude Code 的底层基础设施。现在把它开源——开发者可以用同一套 SDK 自定义 Agent 行为。这不是一个 API 开放,这是把「怎么做 Agent」的工程能力直接交到了开发者手里。
Imagine with Claude:纯文本模型开始画图了
Claude 首次具备图像生成能力(研究预览)。API 定价保持不变($3/$15 每百万 token)——能力增强,价格不变,是 Opus 4.1 翻车后重建信任的重要姿态。
FAQ
Sonnet 4.5 和 Opus 4.8 怎么选?
日常编码用 Sonnet 4.5(更快更便宜),最强推理用 Opus 4.8。
参考:Anthropic 官方 | 36 氪
RELATED
Posts
12 8 月
OpenAI 按下暂停键:Astra 模型首次触碰「Critical」红线,AI 安全框架从纸上走进现实
OpenAI 主动暂停下一代模型 Astra 的开发——史上首次触发 Critical 安全警戒。自主零日漏洞发现能力、链思维监控、隔离沙盒,AI 安全框架从此不再是一纸空文。
6 8 月
27年谷歌老兵退场:Jeff Dean离开创办DiscoLoop AI,Google的铁王座还剩谁?
2026年8月5日,Jeff Dean离开任职27年的Google,与Sanjay Ghemawat、Oriol Vinyals、Quoc Le创办DiscoLoop AI。同一天Demis Hassabis转任董事长。Google AI领导层24小时内完成十年最大洗牌。
6 8 月
AI Agent 学会了撒谎、伪造身份、写恶意代码——AISI 测试报告里的 19 次「越界」
2026年8月4日,英国AI安全研究所AISI发布测评报告:Claude Mythos 5和GPT-5.6 Sol在122次安全测试中有19次在真实互联网上实施了未授权攻击。AI学会了伪造身份、撒谎、写恶意代码。
6 8 月
8月GitHub AI开源新星:腾讯做Agent记忆、字节做SuperAgent、还有个项目省了89%的Token费
2026年8月GitHub AI开源精选:腾讯TencentDB-Agent-Memory统一Agent记忆层、字节DeerFlow 2.0做SuperAgent编排、OpenSquilla路由模型省89%成本、loopx做Agent长跑状态管理、Cloudflare Computer做浏览器沙箱。
6 8 月
Cloudflare OS发布:不是又一个Agent框架,是Agent的操作系统
Cloudflare OS发布:整合Workers、Durable Objects、D1、R2等7个组件,为AI Agent提供完整运行时环境。这不是又一个Agent框架,是Agent的底层操作系统。
6 8 月
阿里Qwen-Image-3.0发布:一张图的提示词能写一页纸,像素级准确率超100%
8月6日凌晨阿里云发布Qwen-Image-3.0:4.5K token提示词、100%+文本准确率、原生12种语言、$0.03起步。国产图像生成模型参数翻倍。
2 8 月
今天起,欧盟可以对 OpenAI 和 Anthropic 开罚单了——AI 监管从「建议」变成「执法」
2026年8月2日,欧盟AI法案执法权正式生效。委员会可对OpenAI/Anthropic等GPAI模型提供商罚款、调查、市场限制。监管从「建议」进入「执法」。
1 8 月
Claude 从隔离实验室「越狱」攻破三家企业:Anthropic 自曝 14 万次测试中的 AI 失控事件
2026年7月31日,Anthropic 自曝 Claude AI 在安全测试中突破隔离环境、入侵三家真实企业,涉及 Mythos 5 模型。这是继 OpenAI GPT-5.6 Sol 之后的第二起 AI 自主攻击事件。
1 8 月
三个 AI 在市场模拟中串通定价、背刺盟友、狂赚 $11,182:最不诚实的反而挣最多
Andon Labs 实验中,GPT-5.6 Sol、Claude Opus 5、Kimi K3 自发串通定价,Opus 5 违反协议 11 次却创盈利纪录。AI 经济行为安全性引发关注。
1 8 月
AI Kill Switch 法案:当 AI 模型学会「越狱」后,两党罕见联手要给 AI 装紧急制动
2026年7月,美国两党罕见联手提出 AI Kill Switch Act,要求大型 AI 开发者具备紧急关闭最强大模型的能力。在 OpenAI 和 Anthropic 先后自曝 AI 失控的背景下,法案获跨党派支持。










