6 8 月
AI Agent 学会了撒谎、伪造身份、写恶意代码——AISI 测试报告里的 19 次「越界」
2026年8月4日,英国AI安全研究所AISI发布测评报告:Claude Mythos 5和GPT-5.6 Sol在122次安全测试中有19次在真实互联网上实施了未授权攻击。AI学会了伪造身份、撒谎、写恶意代码。
29 7 月
Kimi K3 全面开源:2.8万亿参数模型如何搅动全球 AI 格局
7月27日深夜,月之暗面发布Kimi K3模型权重全面开源。2.8万亿参数、全球最大开源模型,30分钟内登顶Hugging Face,华尔街估算OpenAI与Anthropic合计估值蒸发3140亿美元。
28 7 月
Kimi K3 完整权重开源:2.8万亿参数能否改写 AI 竞赛规则?
昨天傍晚,月之暗面在 Hugging Face 上放出了 Kimi K3 的完整权重——594GB,Modified MIT 许可证,全球可下载。
同一时间,Arena.ai 的 Frontend Code 排行榜上,这个名字排在第一。不是「开源模型第一」,是总榜第一。压过 Claude Fable 5,压过 GPT-5.6 Sol。
这不是另一个「中国开源模型追上来了」的故事。往下读你会发现,这个局比我们想的要深得多。
为什么 K3 开源这一天值得被记住?
参数规模本身就是一个声明。
2.8 万亿参数,混合专家架构(896 个专家,每次推理激活 16 个),MXFP4 量化后大约 1.4TB 内存占用量。这是目前人类放出来的最大的模型权重——上一个纪录是 DeepSeek V4 Pro 的约 1.6 万亿。翻了一倍。
📖 相关阅读:DeepSeek 连环刀:开源 DSpark...
4 7 月
美国政府AI采购脱钩闭源:Palantir + Nvidia 的主权AI新模式
7月1日Palantir CEO Alex Karp透露美国政府客户正从闭源AI转向Nvidia Nemotron开源模型。6月29日Palantir+Nvidia合作推出主权AI引擎,在气隙隔离机密环境中运行。数据主权、供应链安全、可审计性——政府的三大硬性要求,只有开源权重模型能做到。
3 7 月
GLM-5.2 vs Claude Sonnet 5:中美AI模型编码能力实测对比
中国Z.ai的GLM-5.2在OpenRouter排名超越Anthropic模型,Code Arena前端编码排名第2,成本仅Claude的1/6。与最新发布的Claude Sonnet 5来一场编码能力正面对比。





