3 6 月

Step 3.7 Flash vs 腾讯 Hy3 Preview:国产 Agent 基座模型的「效率」军备赛

> AI 摘要 > - Step 3.7 Flash:198B MoE(仅激活 11B),400 tokens/s,Agent 单任务成本仅为 Claude Opus 4.6 的 1/9 > - 腾讯 Hy3 Preview:295B MoE(激活 21B),256K 上下文,快慢思考融合,两...
2 6 月

MiniMax M3 全解析:国产开源模型首次配齐「前沿三件套」,百万上下文不再只是纸面参数

为什么 MiniMax M3 值得你花10分钟读完? 6月1日,MiniMax 发布了新一代旗舰模型 M3。如果你已经对模型发布会感到麻木 - - 理解。但这次有三件事同时发生,而且每一件单独拿出来都够写一篇文章。 第一:M3 是国产开源模型里第一个同时具备 Frontier Codin...
2 6 月

Google Deep Research 接入 MCP 协议:从「查资料工具」到「通用数据分析师」

从「查资料机器」到「通用数据分析师」 AI 写研究报告这件事,过去两年经历了三个阶段。 第一阶段是「联网搜索 + 总结」。你问一个问题,AI 搜索网页,返回一堆链接加一段摘要。能用,但像极了实习生交的周报 - - 有字数,没深度。 第二阶段是「多步自主研究」。2025年12月,Goog...
30 5 月

22 天 10+ 款前沿发布:2026 年 5 月 AI 模型马拉松全景解读

2026年5月是AI史上最密集发布月:GPT-5.5 Instant、Gemini 3.5 Flash、Claude Opus 4.8等10+款前沿发布全景解读。从参数竞赛到Agent化范式转变。
29 5 月

星巴克 AI 翻车实录:一个 99% 准确率的模型,为什么在 11,000 家门店被集体拔线?

试点成功的 AI 系统 ≈ 一个闭卷考满分的实习生进了真实仓库——问题不在模型,在现实世界的方差。拆解星巴克 AI 失败的三个致命陷阱及企业部署必备的三个护栏。