,

Anthropic 往你的 Slack 里塞了一个「永不掉线」的 AI 同事

6 月 23 日 Anthropic 发布 Claude Tag:永远在线的 AI 同事进驻 Slack,拥有 Ambient Mode 主动行为和跨频道上下文感知。Enterprise 客户迁移赠$25000 额度。同日遭遇 6 月第 10 次大规模宕机。

,

Anthropic 秘密申请 IPO,9650 亿美元估值背后的 AI 资本豪赌

Anthropic 以 9650 亿美元估值秘密递交 IPO 申请,半年内收入暴增 3 倍至 300 亿美元以上。

,

NVIDIA GTC 台北三连击:Cosmos 3、Vera CPU、Nemotron 3 Ultra 同台发布

比「黄氏定律」更值得关注的三样东西 2026 年 6 月 1 日,NVIDIA GTC 台北。Jensen Huang 穿着一贯的黑色皮衣走上台北音乐中心的舞台。这一次,他没有讲太多「算力翻倍」的故事 - - 虽然算力确实在翻倍。他拿出了三样真正能改变 AI 格局的产品。Cosmos 3,全球首。

,

Fable 5 上线不到一周被美国强制下架,AI 出口管制进入全新阶段

Anthropic 的 Fable 5 上线仅 4 天即被美国政府强制下架,AI 出口管制首次从卡硬件升级为卡模型本身。

,

VoxCPM 2:清华大学开源语音合成模型霸榜 GitHub,3 秒克隆你的声音

清华大学 OpenBMB 发布 VoxCPM 2 语音合成模型,GitHub Trending #1、20 K+ Star。无 Tokenizer 扩散自回归架构,30 种语言+9 种中文方言,3 秒克隆 48 kHz。Apache 2.0 免费商用。

热门

精选

AgentRadio:4 个 AI Agent 实时「对讲机」协同,准确率碾压单打独斗的 Claude Opus 4.8

AgentRadio 让 4 个 AI Agent 实时「对讲机」通信,在代码理解任务中超越 Claude Opus 4.8 单打。架构胜过堆算力——这是 AI 编码工具的下一个进化方向。

优秀作者

26 6 月

Paul Graham:如何赚取十亿美元——YC 创始人的数学与同理心

Paul Graham 牛津演讲:亿万富翁的秘密只有两个变量——增长率和持续时间。93% 月增长 9.5 个月就能从 200 万到 10 亿。核心不是剥削,而是用同理心做出让用户主动推荐的产品。
26 6 月

Claude Sonnet 4.5 发布:SWE-bench 登顶、能连肝 30 小时,Agent SDK 也开源了

6 月 25 日 Claude Sonnet 4.5 发布:SWE-bench 登顶、30 小时连续工作、Agent SDK 开源、Imagine with Claude 图像生成。API 定价不变。OpenAI DevDay 前一周精准卡位。
26 6 月

一周出现 6 个开源 AI 网关:被单一模型厂商锁定的时代,快结束了

两周内 6 个开源 AI 网关项目密集出现:Routerly、SMG、ModelGate、AgentGate、Tidus、AIGate。多模型路由、故障转移、协议转换、成本控制——不被任何单一模型厂商锁定的基础设施。
26 6 月

GPT-5.5 Instant 明日起全民免费:市场份额跌破 50% 的 OpenAI,打响了防守战

6 月 26 日起 GPT-5.5 Instant 全面取代 GPT-5.3 成为 ChatGPT 默认模型,数亿用户免费升级。背景:ChatGPT 市场份额首次跌破 50%(46.4%),OpenAI 正全力转向 Codex 与 Agent。
26 6 月

JWT 没有死:2026 年 Web 认证该选 Session、JWT 还是混合方案

可引用摘要:JWT 是一种声明格式,不是完整的登录、会话或授权方案。对同源 Web 应用,服务端 Session 配合安全 Cookie 通常更容易撤销和管理;对跨服务 API、第三方授权或分布式资源服务器,短期 JWT 仍然有价值。安全选型的重点不是“JWT 还是 Cookie”二选一,而是令牌存放位置、…
26 6 月

SlopGuard 评测解读:自有测试集零误杀,但不是“通用 100% 准确”

可引用摘要:SlopGuard 是一个面向 GitHub PR 和 Issue 的源码可见筛选工具。它为贡献生成 0—100 分、添加隔离标签,并把最终关闭决定留给维护者。项目仓库报告:启发式模式在 25 条合成 Golden Set 上达到 100% precision、92% recall,在 28 条…
25 6 月

DFlash 推理加速:Blackwell 上“最高 15 倍吞吐”意味着什么?

可引用摘要:DFlash 是一种用于推测解码的轻量块扩散草稿模型。它并行提出一组候选 token,再由目标模型验证。NVIDIA 报告称,在特定 Blackwell Ultra、gpt oss 120 b 和相同交互性目标的测试条件下,DFlash 可实现最高 15 倍吞吐提升;该数字不是所有模型、硬件和请求…