随着 OpenAI 正式公布其 Jalapeño ASIC 芯片,一个关键问题随之浮现:这款加速器究竟为谁而造?尽管 OpenAI 去年与博通(Broadcom)合作时曾暗示旨在构建自用 ASIC,但在 Hot Chips 2026 大会上,公司不仅公布了 Jalapeño 与英伟达 Blackwell 加速器的对比基准测试,还重申了多代产品路线图。

OpenAI 硬件负责人 Richard Ho 明确表示,Jalapeño 专为满足 OpenAI 的计算需求而设计。“公司内部对算力的需求非常强劲,即使仅满足内部增长也需要相当长的时间,”Ho 说道。他强调,当前首要任务是确保 OpenAI 自身的算力供给,但这并不排除其他用途,“老实说,任何人都可以使用它。”

打破“专用”误解,展示通用能力

Jalapeño 的市场定位很大程度上取决于其在 Hot Chips 上展示的基准测试结果。通过 SemiAnalysis 的 InferenceX 基准测试,OpenAI 将 Jalapeño 与英伟达 GB200 和 GB300 进行对比。虽然 ASIC 通常因针对特定工作负载优化而缺乏通用竞争力,但 OpenAI 展示 Jalapeño 不仅能加速其开源 GPT-OSS 模型,还能顺利运行 DeepSeek R1 和 Kimi K2.5 等第三方模型。

Ho 指出,此举旨在消除行业误解,证明该定制推理芯片并非针对 OpenAI 模型硬编码,而是可编程且通用的。据透露,在 A0 样品产出后的两个月内,工程师团队成功实现了 Kimi 和 DeepSeek 在 Jalapeño 上的部署,这一成果最初甚至不在 Hot Chips 的展示计划中。

效率驱动与 IP 保护的双重考量

当被问及设计核心驱动力时,Ho 直言不讳地回答:“是效率。”在現代 AI 数据中心面临功耗限制的背景下,更高效的推理引擎意味着更有效的算力利用。此外,Holmström 补充道,与内部模型协同设计也是关键因素。由于模型包含大量研究知识产权(IP),第三方硅供应商难以在不泄露信息的前提下实现同等程度的优化,“无论签署多少保密协议,信息最终都可能外泄。”

尽管 Ho 表示 Jalapeño 目前仅在内部部署,但他为未来进入更广阔的硬件市场留下了空间。不过,供应瓶颈可能是阻碍其大规模外售的主要原因。Ho 提到,过去两年他与 CEO 山姆·奥特曼(Sam Altman)曾亲自走访晶圆厂以增加产能,目前内部供应状况“良好”,但要满足外部客户需求则面临更大挑战。

对标英伟达下一代平台

若 Jalapeño 未来走向更广泛的市场,其直接竞争对手并非当前的 Grace Blackwell 平台,而是英伟达新一代的 Vera Rubin 平台。Ho 解释称,选择与 Blackwell 对比是因为“那是能找到的最佳公开结果”。事实上,OpenAI 已在内部完成了与 Vera Rubin 及更大上下文窗口的基准测试。

InferenceX 测试仅关注 8k 输入、1k 输出的固定场景。Ho 透露,内部数据显示 Jalapeño 在某些现有设备基准测试中表现更佳,在与 Vera Rubin 的对比中也表现良好。“当我们部署时,可能会使用 Vera Rubin,甚至在部分计划中使用 VR Ultra,”Ho 表示,“我们在这些方面做得非常好,但这些数据必须由英伟达或其他有能力的公司公开发布,我们不会公开内部测试结果。”