28 7 月

红蓝绿三队 AI Agent 守护代码安全:微软 Perception 平台解读

7 月 27 日,微软在旧金山搞了一场不大不小的发布会。 不大,是因为场地不大,邀请的媒体也不多。不小,是因为 Mustafa Suleyman 亲自站台了。 📖 相关阅读:AI 巨头的 FDE 军备竞赛:Palantir、AWS、Microsoft、OpenAI、Anthropic 五路并进 — Perception 发布是微软在这场军备竞赛中的最新一步 这位 DeepMind 联合创始人、现在微软 AI 的 CEO,用他那标志性的英伦口音说了一句话让我印象很深,「We're shipping this into production immediately」——我们立刻把它推进生产。 他说的是两样东西。一个是 MAI-Cyber-1-Flash,微软第一款自研的网络安全模型。另一个是 Project Perception,一个用红蓝绿三队 AI Agent 协同工作的安全平台。 坦率的讲,安全领域的发布会我看了不少,大多乏善可陈。无非是「我们又加了 AI」「我们检测率提升了 X%」这类 PPT 数字。但这次不一样,这次微软拿出了一张成绩单,CyberGym 基准测试...
4 7 月

Claude Science 深度解析:Anthropic 从代码进军生物医药的跨界野心

6月30日Anthropic发布Claude Science——AI科学工作台,集成60+数据库与Agent协同架构。同步宣布自研药物计划,从编程跨界生物医药。既是制药公司的供应商,又是竞争对手。
3 7 月

Claude Sonnet 5 深度评测:三天实测 Anthropic 最新中端旗舰

Anthropic 6月30日发布 Claude Sonnet 5,SWE-bench Pro 达 63.2% 逼近 Opus 4.8,Terminal-Bench 2.1 跃升 13 分,价格仅旗舰的 40%,默认成为 Free 用户新模型。三天实测告诉你什么时候用 Sonnet 5,什么时候仍需要 Opus 4.8。
29 6 月

千问输入法 macOS 版实测:语音输入 300 字/分钟,AI 帮你润色

6 月底,阿里千问输入法推出了 macOS 版本。核心卖点:语音输入最快 300 字/分钟,内置 AI 自动润色功能。不是「即将上线」,是现在已经可以在 Mac App Store 下载。 我在一台 M 3 MacBook Pro 上用了三天。以下是真实体验。 语音输入:一开口就是 300 字/分钟? 我用最自然的中文语速朗读了一段技术博客作为测试。计时结果是:1 分钟朗读了约 290 个中文字符,输入法几乎零延迟地全部转录正确。口头语助词(「那个」、「就是」)会被自动过滤。偶尔出现的同音错字(「蒸馏」→「正经流」)可以通过重新朗读该句自动修正。 语音输入在中文场景下的最大痛点是准确率——行业平均水平在 90-95% 之间,意味着每 100 个字有 5-10 个需要手动修正。千问的三天测试下来,日常对话场景的准确率在 97% 左右,中等语速(每分钟 200-250 字)时几乎没有错字。技术文段中英文混排时的准确率会降到 93% 左右——英文专业术语有时被识别为发音相近的中文。 AI 润色:从口语到书面语的一键翻译 语音转文字后,AI 润色是最实用的功能。它不只是修正语法——它会重新组织句子结构,把口语化的表达变成书面文字。我对一段口头叙述做了测试,AI 润色后的文本除了修正口语化表达外,还自动补充了段落结构,使整体逻辑更清晰。不过需要注意的是,AI 润色可能会改变原文的强调重点——重要的观点建议自己手动微调。 跟 macOS 原生输入法比 macOS...
28 6 月

Apple Vision Pro 老大跳槽 OpenAI,同一天 SpaceX 注册了「SpaceXAI」商标

Apple Vision Pro 老大跳槽 OpenAI,同一天 SpaceX 注册了「SpaceXAI」商标 6 月 27 日,TechCrunch 和 The Information 同时爆了一条消息:Apple Vision Pro 及智能眼镜业务的负责人,正在跳槽去 OpenAI。同一天,SpaceX 注册了「SpaceXAI」商标——一个被广泛解读为 Musk 准备正式将 xAI 并入 SpaceX 的信号。两条消息同一天出现,说的是同一件事:AI 的下一个战场,是硬件。 Vision Pro 的老大为什么要走? 近 6 个月:Google DeepMind 核心研究员加入 Anthropic、Meta AI 安全负责人加入 OpenAI、NVIDIA CUDA 架构师被 Anthropic 和...