28 7 月

Kimi K3 完整权重开源:2.8万亿参数能否改写 AI 竞赛规则?

昨天傍晚,月之暗面在 Hugging Face 上放出了 Kimi K3 的完整权重——594GB,Modified MIT 许可证,全球可下载。 同一时间,Arena.ai 的 Frontend Code 排行榜上,这个名字排在第一。不是「开源模型第一」,是总榜第一。压过 Claude Fable 5,压过 GPT-5.6 Sol。 这不是另一个「中国开源模型追上来了」的故事。往下读你会发现,这个局比我们想的要深得多。 为什么 K3 开源这一天值得被记住? 参数规模本身就是一个声明。 2.8 万亿参数,混合专家架构(896 个专家,每次推理激活 16 个),MXFP4 量化后大约 1.4TB 内存占用量。这是目前人类放出来的最大的模型权重——上一个纪录是 DeepSeek V4 Pro 的约 1.6 万亿。翻了一倍。 📖 相关阅读:DeepSeek 连环刀:开源 DSpark...
4 7 月

Meta Watermelon 对标 GPT-5.5:Zuckerberg $1450亿赌注的第一次回响

7月2日Meta内部townhall:Zuckerberg承认AI Agent进度不及预期,AI主管Wang却声称Watermelon已对标GPT-5.5。$1450亿年度AI投入的第一次回响,背后是被中国开源模型挤压的Llama和闭源转型。
24 6 月

豆包 2.1 Pro 发布:字节 AI 全家桶如何跨越生产级「质变点」

6月23日火山引擎FORCE大会:豆包2.1 Pro发布,Coding与Agent双跨越生产级质变点,日均Token调用突破180万亿。Seedance 2.5直出30秒视频,四大模型矩阵构建字节AI全家桶。
7 6 月

智谱一口气开源 6 款模型:200 tokens/s + z.ai 域名,国产开源模型的「降维打击」又升级了

6 月 4 日,智谱做了一件极其「大方」的事: 一次性开源三大类 6 款 GLM 模型,覆盖沉思、推理、基座。 推理速度 200 tokens/s 刷新国内商用纪录,价格仅为 DeepSeek-R1 的 1/30。同时拿下顶级域名 z.……
6 6 月

OpenAI「自进化」Codex 实锤曝光:6 周准确率从 25% 飙升到 86%,没有一个人碰过代码

一个 AI 系统,没人重训模型,没人重写代码,6 周内自己把准确率从 25% 拉到了 86%。这不是科幻——这是 OpenAI 刚披露的 Tax AI 系统的真实表现。 Codex 分析自己的输出日志、定位 Bug、写修复方案、运行测试……