OpenAI 联手博通推出首款 LLM 推理专用芯片 Jalapeño

OpenAI 与博通(Broadcom,纳斯达克股票代码:AVGO)今日发布了 OpenAI 首款智能处理器 Jalapeño。该芯片是围绕 OpenAI 对大语言模型(LLM)推理未来的愿景而架构的加速器,也是双方共同构建的多代计算平台中的首款 AI 加速器,旨在让先进 AI 更快速、更可靠且更易于普及。

文章图片

Jalapeño 芯片由博通总裁兼首席执行官 Hock Tan 和总裁 Charlie Kawwas 交付给 OpenAI 首席执行官 Sam Altman 和总裁 Greg Brockman,这标志着 OpenAI 在构建其模型和产品底层全栈战略中迈出了重要一步。

OpenAI 基于对 LLM 基础原理的深刻理解,结合其模型路线图、内核、服务系统及产品需求,与合作伙伴博通和 Celestica 共同从零开始设计了该芯片。通过芯片实现、电路板、机架系统集成、高性能网络和可扩展生产系统,实现了平台的工业化。Jalapeño 的设计具有灵活性,能够适配行业内当前及未来的所有 LLM。目前,Jalapeño 芯片的工程样品正在实验室中以生产目标频率和功耗运行机器学习工作负载,包括 GPT-5.3-Codex-Spark。

虽然 OpenAI 仍在评估最终性能,但早期测试显示,Jalapeño 的每瓦性能将显著优于当前最先进的水平。关于性能的详细技术报告将在未来几个月内发布。该架构减少了数据移动,并平衡了计算、内存和网络资源,使实际利用率更接近理论峰值性能。博通的硅实现和网络技术(包括 Tomahawk 网络芯片)助力该平台实现大规模生产。

专为 LLM 推理打造的顶级平台

Jalapeño 是一款专为现代 LLM 推理设计的全新架构,而非从早期 AI 工作负载改造而来的通用加速器。它基于 OpenAI 在 ChatGPT、Codex、API 及未来智能体产品中日常运行的系统经验,同时兼顾了行业内当前及未来的 LLM 需求。其目标是将当今领先 AI 加速器的算力和吞吐量与最快专用推理系统的低延迟相结合,使 Jalapeño 非常适合大规模交互式 LLM 产品。

这就是全栈优势。OpenAI 不仅在开发前沿模型或在其之上构建产品,还在设计其底层的基础设施:芯片架构、内核、内存系统、网络、调度、部署系统和产品体验。由于 OpenAI 在整个技术栈中运作,每一层都可以围绕同一个目标进行优化:使模型对用户而言更快、更可靠、更经济。

Jalapeño 强化了 OpenAI 进步背后的飞轮效应。更好的基础设施推动计算效率,更高的计算效率实现更好的训练和服务,最终驱动能力更强的 AI 模型。更好的模型转化为对个人、开发者和企业更好的产品。更好的产品带来更多的使用量、更多的客户和更多的收入,从而让 OpenAI 能够重新投资于下一代基础设施。随着时间的推移,这一循环有助于使智能变得更强大、更可靠且成本更低。

九个月完成流片,由 OpenAI 模型加速

Jalapeño 从初步设计到制造流片仅用了九个月时间,这一定制 AI 加速器项目被认为是高性能先进半导体领域有史以来最快的 ASIC 开发周期。这种速度反映了 OpenAI 工程团队与博通硅实现专业知识之间的深度软硬件协同开发,以及利用 OpenAI 模型来加速设计和优化过程的部分环节。

服务于用户的模型同样在帮助改进用于运行未来模型的底层基础设施。如果 AI 能帮助工程师更快地设计出更好的芯片,它就能降低整个行业的计算成本,并有助于普及对先进 AI 的访问。

与合作伙伴共建多代平台

Jalapeño 是多代计算平台的第一步,该平台旨在 2026 年底前进行初步部署,并在未来几年内扩展。它结合了 OpenAI 设计的加速器、博通的硅实现、网络和连接技术,以及 Celestica 在电路板、机架和系统方面的专业知识。

让先进 AI 更广泛地普及

这项工作的意义很简单:推理是 AI 触达大众的环节。成本、速度和可靠性的每一次提升,都能体现为更快的 ChatGPT 回答、执行步骤更多且等待时间更短的 Codex 任务、构建成本更低的 API 产品,或在需求高峰期更可靠的访问体验。

普及 AI 意味着让先进模型变得可用、可靠且经济实惠,足以让更多人每天使用。Jalapeño 帮助 OpenAI 将更多的基础设施转化为有用的智能,服务于学生、开发者、小型企业、研究人员、企业以及任何试图学习、创造或解决难题的人。


来源:OpenAI|原文链接