MCP 协议进入 v 2 时代:从「会话」到「无状态」,本周四个重要更新你该知道

MCP Python SDK v 2 Alpha 发布(协议从有状态→无状态),ClickHouse 托管 MCP Server 上线,GPU-MCP-Server 开源,MDN MCP Server 发布。MCP 正从开发者玩具变成 AI 基础设施协议。

AI 正在学会「不在你身边时自己干活」:Conway 泄露与 ChatGPT Scheduled Tasks 同天曝光

2026 年 6 月 20 日,Anthropic 未公开的常驻 Agent「Conway」和 OpenAI 的 ChatGPT Scheduled Tasks 同时登上头条。AI 产品正在从「你来问我才答」转向「我在后台帮你看着」。

OpenAI 按下暂停键:Astra 模型首次触碰「Critical」红线,AI 安全框架从纸上走进现实

OpenAI 主动暂停下一代模型 Astra 的开发——史上首次触发 Critical 安全警戒。自主零日漏洞发现能力、链思维监控、隔离沙盒,AI 安全框架从此不再是一纸空文。

,

NVIDIA GTC 台北三连击:Cosmos 3、Vera CPU、Nemotron 3 Ultra 同台发布

比「黄氏定律」更值得关注的三样东西 2026 年 6 月 1 日,NVIDIA GTC 台北。Jensen Huang 穿着一贯的黑色皮衣走上台北音乐中心的舞台。这一次,他没有讲太多「算力翻倍」的故事 - - 虽然算力确实在翻倍。他拿出了三样真正能改变 AI 格局的产品。Cosmos 3,全球首。

热门

精选

AgentRadio:4 个 AI Agent 实时「对讲机」协同,准确率碾压单打独斗的 Claude Opus 4.8

AgentRadio 让 4 个 AI Agent 实时「对讲机」通信,在代码理解任务中超越 Claude Opus 4.8 单打。架构胜过堆算力——这是 AI 编码工具的下一个进化方向。

优秀作者

28 5 月

Claude Code 自动模式搞砸了你的项目?Boris 教你 5 个步骤让它真正干活

Claude Code 创作者 Boris Cherny 分享自动模式多任务并行技巧。5 步实操指南:任务拆分→验证标准→优先级编排→并行执行→结果汇总。附 CLAUDE.md 配置模板。
27 5 月

别再为这些工具付费了,这 30 个开源替代品让你的月账单直接砍半

上个月我认真拉了一遍 SaaS 账单,吓了一跳。本文从 100 个开源 GitHub 仓库中精选 30 个最实用的替代品——n 8 n 替代 Zapier、Penpot 替代 Figma、Ollama 替代 ChatGPT 订阅——按六大类逐一拆解,每项标注许可证和坑点。
27 5 月

AI 视频生产三连击:Runway Luxo + Gemini Omni + Kling 同时跨过「能用」门槛

如果你对 AI 视频的印象还停留在「那些有点诡异的六指人类和违反物理定律的物体运动」,今天有三个独立信号在告诉你:可以更新认知了。 Runway Luxo:跨越恐怖谷 Runway 今天发布了 Project Luxo 的研究结果,核心结论只有一句话:AI 生成视频已经跨过了恐怖谷。 他们做了什么?向创意行业的从业者展示了包括 AI 短片《The Rogue》和广告样片在内的作品,然后评估观众的反应。结果是:观众开始关注故事本身,而不是技术瑕疵。 更有意思的是生产效率数据:所有作品都由单人团队制作,耗时从 3 周到 4 小时不等。用 Runway 的话说:「当技术足够好以至于『隐形』,观众沉浸于故事而非技术时,就意味着跨越。」 这个判断标准其实很聪明——它不是用 PSNR 或 FVD 这些技术指标来证明 AI 视频「变好了」,而是用观众的行为数据。当观众不再在弹幕里刷「AI 生成的吧」,AI 视频就真的成熟了。 Gemini Omni:不只是生成,而是「拍摄」 同一天,Google 官方发布了 Gemini Omni 的视频提示词指南。五条技巧,每一条都值得细读: 利用模型已有的现实世界知识。Gemini Omni 的训练数据包含了大量现实世界的视觉信息,你不需要描述「一辆红色的汽车长什么样」,直接说「一辆红色特斯拉 Model 3 在太平洋海岸公路上行驶」就行。 精确控制文本渲染。视频中的文字排版一直是 AI 视频的弱项,Gemini Omni 在这方面做了针对性优化,支持指定字体、位置和动效。 使用专业镜头指令。推拉摇移、景深、构图——用电影摄影师的术语来写提示词,而不是「拍得好看一点」。 迭代编辑而非重拍。不需要因为一个细节不满意就重新生成整个视频。可以像改代码一样在上一版基础上修改。 直接调整角色的动作节奏或情绪。对于叙事类内容,这个能力意味着你不需要重新设计角色动画,只需要告诉模型「让她走得更快一点」或「表情更紧张」。 这些技巧看起来简单,但背后反映的是。
27 5 月

「选择保持人性」— Ethan Mollick 最新长文:当 AI 能写出一切,什么内容还值得人类亲自生产?

Ethan Mollick 是沃顿商学院教授,也是 AI 领域最受关注的博主之一(One Useful Thing)。他今天发表了一篇新文章,标题直接得刺眼—— 《Choosing to Stay Human》(选择保持人性)。你在……
27 5 月

ECC 开源项目深度拆解:19 万星的 Agent 性能调校系统,给 AI 编程装上「变速箱」

如果你用过 Claude Code 或 Codex CLI 写代码,大概率遇到过这种情况:agent 为一个简单功能读了 15 个不相关的文件,调用了 8 个不需要的工具,烧掉了一大堆 token,最后代码还没写好。 ECC 要解决的就是这个问题。 ECC 是什么? ECC 的全称很长——「The agent harness performance optimization system」(Agent 执行层性能优化系统)。简单说,它像是给 AI 编程 agent 装了一个「变速箱」和「刹车」,告诉 agent:这个场景下你只需要看这些文件、用这些工具、以这种节奏工作。 它的核心模块包括 5 个: Skills。定义 agent 在特定场景下使用的能力清单。比如「debug 模式」下 agent 可以读日志、跑测试、查看 git diff;「refactor 模式」下 agent 可以用 replace_content...
26 5 月

中国企业出海七大模式全解析:2025-2026 年全球化路径与战略选择

2025 年 A 股上市公司境外收入首次突破 12.4 万亿元,占比近 17%。本文拆解借港出海、区域深耕、并购整合、跨境电商、技术赋能、物流协同、资本运作七大出海模式,结合比亚迪、海尔、美的等最新案例,提供出海模式决策框架。
26 5 月

Cursor Composer 2.5 实测:一个 Kimi K 2.5 微调模型,凭什么在代码基准上对标 Opus 4.7——价格只要 1/60

5 月 18 日,Cursor 发了 Composer 2.5。 没有发布会,没有博客预告。一个周日下午,版本号悄悄跳了。社区开始跑分,然后数据出来了:SWE-bench Multilingual 79.8%,比 Composer 2 高了 6 个百分点。CursorBench 默认模式下 63.2%,超过 Opus 4.7 的 61.6%。但真正让开发者社区讨论的不是分数——是价格。 Standard 模式下,每任务成本 $0.07。Opus 4.7 max 是 $4.10。差了将近 60 倍。 Key Takeaways – Composer 2.5 SWE-bench 79.8% 对标 Opus 4.7 的 80.5%,CursorBench 默认模式 63.2%...