OpenAI 自研推理芯片 Jalapeño 跑分超英伟达
2026-08-27 | AI 工作流每日动态
OpenAI 在 Hot Chips 大会上公布了与博通联合打造的首款自研推理芯片 Jalapeño 的技术细节和跑分数据。这是 OpenAI 向硬件上游延伸的标志性一步。
关键数据
- 能效比领先:在三款公开模型上,每千瓦吞吐量达到英伟达系统的 1.5 至 1.9 倍
- 研发速度惊人:从设计到流片仅用 9 个月,远快于行业平均的 18-24 个月
- AI 设计芯片:借助 Codex 等工具 AI 生成 kernel,加速芯片设计全流程
- 部署计划:2026 年底以极小规模部署,主要用于自有推理服务
技术架构亮点
Jalapeño 的设计哲学是"少搬数据":
- 核心与 HBM4 内存切片直连,减少数据搬运
- Prefill 与 Decode 在同一芯片上完成
- 专为推理负载优化,而非通用计算
为什么值得关注
- 定价权之争:OpenAI 自研芯片的核心目标是对外出租推理算力,降低对英伟达的依赖,掌握 AI 服务的定价权。
- 推理成本下降:更高效的推理芯片意味着 AI 应用的边际成本将进一步降低,加速 AI 商业化落地。
- 行业信号:从 Anthropic 450 亿美元锁定算力,到 OpenAI 自研芯片,头部 AI 公司都在拼命争夺算力自主权。
来源:Hot Chips 大会、OpenAI 官方发布

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论