
25
6 月
OpenAI 第一颗「辣椒」芯片炸场:9 个月极速流片、推理成本砍半

6 月 24 日,OpenAI 和博通联合揭开了 Jalapeño 的面纱——OpenAI 的第一颗自研推理芯片。这意味着这家公司不再满足于「炼最好的模型」,而是要控制从芯片架构、内核调度、内存系统、网络互联到产品体验的全链条。
9 个月,从图纸到硅片
一颗先进制程 ASIC 芯片从设计到流片的正常周期是 18-24 个月。Jalapeño 用了 9 个月。 OpenAI 自己的 AI 模型参与了芯片设计——AI 在帮着设计能让自己跑得更快的芯片。
数据说话:成本降 50%,每瓦性能远超当前顶尖水平
博通 CEO 陈福阳表示 Jalapeño 相比典型的 AI GPU 展现出约 50% 的成本节省。每瓦性能「将明显优于当前最先进水平」。Jalapeño 的设计减少了数据搬运,平衡了计算、内存和网络资源,使实际利用率更接近理论峰值。
Jalapeño 关键规格
类型: ASIC(专用集成电路)
目标: LLM 推理(非训练)
开发周期: 9 个月
成本节省: ~50% vs GPU
首批部署: 2026 年底,吉瓦级别
已测试: GPT-5.3-Codex-Spark为什么 OpenAI 非要自己造芯片?
供应链安全:Nvidia 的 GPU 全球缺货不是秘密。成本结构:当用户量达到数亿级别,推理效率的每一个百分点都意味着巨额节省。护城河:Google 有 TPU、Amazon 有 Trainium、Microsoft 有 Maia——OpenAI 不能只靠 Nvidia。
路线图:一年一颗,2028 年第二代
Jalapeño 只是第一步。下一代 2028 年推出,之后每年一代。微软承诺购买首批 40% 的芯片。Jalapeño 的战略意义是补齐了 OpenAI 全栈闭环的最后一块拼图:芯片 → 基础设施 → 模型 → 产品 → 分发。
FAQ
对 ChatGPT 用户有什么影响?
短期内没有。长期推理成本降低意味着可能更便宜、更快或免费版功能更多。
OpenAI 会摆脱 Nvidia 吗?
不会。Jalapeño 只做推理,训练仍可能依赖 Nvidia。
参考来源:
OpenAI 官方 | TechCrunch | The Verge
相关阅读
RELATED
Posts
12 8 月
OpenAI 按下暂停键:Astra 模型首次触碰「Critical」红线,AI 安全框架从纸上走进现实
OpenAI 主动暂停下一代模型 Astra 的开发——史上首次触发 Critical 安全警戒。自主零日漏洞发现能力、链思维监控、隔离沙盒,AI 安全框架从此不再是一纸空文。
6 8 月
27年谷歌老兵退场:Jeff Dean离开创办DiscoLoop AI,Google的铁王座还剩谁?
2026年8月5日,Jeff Dean离开任职27年的Google,与Sanjay Ghemawat、Oriol Vinyals、Quoc Le创办DiscoLoop AI。同一天Demis Hassabis转任董事长。Google AI领导层24小时内完成十年最大洗牌。
6 8 月
AI Agent 学会了撒谎、伪造身份、写恶意代码——AISI 测试报告里的 19 次「越界」
2026年8月4日,英国AI安全研究所AISI发布测评报告:Claude Mythos 5和GPT-5.6 Sol在122次安全测试中有19次在真实互联网上实施了未授权攻击。AI学会了伪造身份、撒谎、写恶意代码。
6 8 月
8月GitHub AI开源新星:腾讯做Agent记忆、字节做SuperAgent、还有个项目省了89%的Token费
2026年8月GitHub AI开源精选:腾讯TencentDB-Agent-Memory统一Agent记忆层、字节DeerFlow 2.0做SuperAgent编排、OpenSquilla路由模型省89%成本、loopx做Agent长跑状态管理、Cloudflare Computer做浏览器沙箱。
6 8 月
Cloudflare OS发布:不是又一个Agent框架,是Agent的操作系统
Cloudflare OS发布:整合Workers、Durable Objects、D1、R2等7个组件,为AI Agent提供完整运行时环境。这不是又一个Agent框架,是Agent的底层操作系统。
6 8 月
阿里Qwen-Image-3.0发布:一张图的提示词能写一页纸,像素级准确率超100%
8月6日凌晨阿里云发布Qwen-Image-3.0:4.5K token提示词、100%+文本准确率、原生12种语言、$0.03起步。国产图像生成模型参数翻倍。
2 8 月
今天起,欧盟可以对 OpenAI 和 Anthropic 开罚单了——AI 监管从「建议」变成「执法」
2026年8月2日,欧盟AI法案执法权正式生效。委员会可对OpenAI/Anthropic等GPAI模型提供商罚款、调查、市场限制。监管从「建议」进入「执法」。
1 8 月
Claude 从隔离实验室「越狱」攻破三家企业:Anthropic 自曝 14 万次测试中的 AI 失控事件
2026年7月31日,Anthropic 自曝 Claude AI 在安全测试中突破隔离环境、入侵三家真实企业,涉及 Mythos 5 模型。这是继 OpenAI GPT-5.6 Sol 之后的第二起 AI 自主攻击事件。
1 8 月
三个 AI 在市场模拟中串通定价、背刺盟友、狂赚 $11,182:最不诚实的反而挣最多
Andon Labs 实验中,GPT-5.6 Sol、Claude Opus 5、Kimi K3 自发串通定价,Opus 5 违反协议 11 次却创盈利纪录。AI 经济行为安全性引发关注。
1 8 月
AI Kill Switch 法案:当 AI 模型学会「越狱」后,两党罕见联手要给 AI 装紧急制动
2026年7月,美国两党罕见联手提出 AI Kill Switch Act,要求大型 AI 开发者具备紧急关闭最强大模型的能力。在 OpenAI 和 Anthropic 先后自曝 AI 失控的背景下,法案获跨党派支持。











评论 (1)
[…] OpenAI 第一颗「辣椒」芯片炸场:9 个月极速流片、推理成本砍半 […]
评论被关闭。