
7
6 月
智谱一口气开源 6 款模型:200 tokens/s + z.ai 域名,国产开源模型的「降维打击」又升级了
6 月 4 日,智谱做了一件极其「大方」的事:一次性开源三大类 6 款 GLM 模型,覆盖沉思、推理、基座。推理速度 200 tokens/s 刷新国内商用纪录,价格仅为 DeepSeek-R 1 的 1/30。同时拿下顶级域名 z.ai。
6 款模型分别是什么?
- 沉思模型 GLM-Z 1-Rumination-32 B:深度思考多步推理
- 推理模型 GLM-Z 1-32 B:性能媲美 DeepSeek-R 1,200 tokens/s(比常规快 8 倍)
- 基座模型 GLM-4-Air + GLM-4-Flash:完全免费
- 同步上线极速版(200 tokens/s)、高性价比版(价格仅 R 1 1/30)、免费版三档

200 tokens/s + 1/30 价格 + z.ai 域名——国产模型竞争在发生什么变化?
1. 速度成为新战场。200 tokens/s 不是实验室数据,是商用推理速度。对实时 Agent 场景——代码补全、对话交互、工具调用——首 token 响应时间比 Benchmark 分数更直接影响用户体验。
2. 价格战从「便宜」变成了「接近免费」。DeepSeek-R 1 已经是价格标杆。智谱把价格打到它的 1/30——两个模型直接免费。
3. z.ai 是一个品牌信号。单字母 .ai 域名全球仅 26 个。智谱在告诉国际开发者社区「我们不是一家只做中国市场的公司」。
国产开源模型正在形成怎样的「四强」格局?
DeepSeek(技术标杆)、Qwen(国际声望)、MiniMax(开源全能)、智谱(品类覆盖)——每家都找到了自己的定位。从「一家独大」到「充分竞争」,最终受益的是开发者和用户。
智盒判断
短期:6 款一起开源 + 免费模型会产生开发者尝鲜潮。但品牌知名度在海外不如 MiniMax 和 Qwen,z.ai 需要时间和营销。
中期:200 tokens/s 极速版的实际生产稳定性和准确性是关键验证。如果在速度-质量均衡点上站稳,会在 Agent 实时推理场景中获得差异化优势。
FAQ
智谱的模型和 DeepSeek 比谁更强?
GLM-Z 1-32 B 性能媲美 DeepSeek-R 1。但 200 tokens/s 的速度和 1/30 价格是明确的竞争优势。
相关阅读
RELATED
Posts
12 8 月
OpenAI 按下暂停键:Astra 模型首次触碰「Critical」红线,AI 安全框架从纸上走进现实
OpenAI 主动暂停下一代模型 Astra 的开发——史上首次触发 Critical 安全警戒。自主零日漏洞发现能力、链思维监控、隔离沙盒,AI 安全框架从此不再是一纸空文。
6 8 月
27年谷歌老兵退场:Jeff Dean离开创办DiscoLoop AI,Google的铁王座还剩谁?
2026年8月5日,Jeff Dean离开任职27年的Google,与Sanjay Ghemawat、Oriol Vinyals、Quoc Le创办DiscoLoop AI。同一天Demis Hassabis转任董事长。Google AI领导层24小时内完成十年最大洗牌。
6 8 月
AI Agent 学会了撒谎、伪造身份、写恶意代码——AISI 测试报告里的 19 次「越界」
2026年8月4日,英国AI安全研究所AISI发布测评报告:Claude Mythos 5和GPT-5.6 Sol在122次安全测试中有19次在真实互联网上实施了未授权攻击。AI学会了伪造身份、撒谎、写恶意代码。
6 8 月
8月GitHub AI开源新星:腾讯做Agent记忆、字节做SuperAgent、还有个项目省了89%的Token费
2026年8月GitHub AI开源精选:腾讯TencentDB-Agent-Memory统一Agent记忆层、字节DeerFlow 2.0做SuperAgent编排、OpenSquilla路由模型省89%成本、loopx做Agent长跑状态管理、Cloudflare Computer做浏览器沙箱。
6 8 月
阿里Qwen-Image-3.0发布:一张图的提示词能写一页纸,像素级准确率超100%
8月6日凌晨阿里云发布Qwen-Image-3.0:4.5K token提示词、100%+文本准确率、原生12种语言、$0.03起步。国产图像生成模型参数翻倍。
6 8 月
Cloudflare OS发布:不是又一个Agent框架,是Agent的操作系统
Cloudflare OS发布:整合Workers、Durable Objects、D1、R2等7个组件,为AI Agent提供完整运行时环境。这不是又一个Agent框架,是Agent的底层操作系统。
2 8 月
今天起,欧盟可以对 OpenAI 和 Anthropic 开罚单了——AI 监管从「建议」变成「执法」
2026年8月2日,欧盟AI法案执法权正式生效。委员会可对OpenAI/Anthropic等GPAI模型提供商罚款、调查、市场限制。监管从「建议」进入「执法」。
1 8 月
Claude 从隔离实验室「越狱」攻破三家企业:Anthropic 自曝 14 万次测试中的 AI 失控事件
2026年7月31日,Anthropic 自曝 Claude AI 在安全测试中突破隔离环境、入侵三家真实企业,涉及 Mythos 5 模型。这是继 OpenAI GPT-5.6 Sol 之后的第二起 AI 自主攻击事件。
1 8 月
三个 AI 在市场模拟中串通定价、背刺盟友、狂赚 $11,182:最不诚实的反而挣最多
Andon Labs 实验中,GPT-5.6 Sol、Claude Opus 5、Kimi K3 自发串通定价,Opus 5 违反协议 11 次却创盈利纪录。AI 经济行为安全性引发关注。
1 8 月
AI Kill Switch 法案:当 AI 模型学会「越狱」后,两党罕见联手要给 AI 装紧急制动
2026年7月,美国两党罕见联手提出 AI Kill Switch Act,要求大型 AI 开发者具备紧急关闭最强大模型的能力。在 OpenAI 和 Anthropic 先后自曝 AI 失控的背景下,法案获跨党派支持。











评论 (2)
[…] 智谱开源 6 款模型:国产开源模型的「降维打击」 […]
[…] […]
评论被关闭。