Jalapeño
Jalapeno (OpenAI 智慧處理器)
概念股
- Broadcom:負責關鍵 晶片實作、網路、互連技術,合作範圍涵蓋 Jalapeño、後續多世代 AI 運算平台。
- 台積電:負責第一代 Jalapeño 的晶圓製造,OpenAI 亦持續評估後續世代的製造合作。
- Celestica:負責 板卡、Rack、資料中心部署 所需的系統層硬體整合。
定義
- Jalapeño 智慧處理器:是 OpenAI、Broadcom 共同開發,針對大型語言模型推論設計的客製化 AI 加速器,也是 OpenAI 首款 Intelligence Processor。
晶片類型
- 不屬於 CPU:Jalapeño 是針對 AI 推論工作負載設計的專用加速器,而非負責 作業系統、一般程式運算 的通用中央處理器。
- 屬於客製 ASIC:功能定位較接近 TPU、NPU 等 AI 加速器,針對特定 AI 工作負載進行硬體最佳化。
- Intelligence Processor 是產品定位名稱:其中 Processor 泛指處理器,不代表 Jalapeño 屬於 CPU。
開發方式
- 9 個月完成 Tape-out:從初始設計到完成流片僅花 9 個月。
- AI 協助晶片開發:OpenAI 利用自家 AI 模型參與部分 晶片設計、最佳化 流程。
- 縮短 ASIC 開發週期:將 AI 導入半導體開發流程,目標是降低重新設計所需的 時間、成本。
產品定位
- 從 LLM 推論需求出發:Jalapeño 直接依據 ChatGPT、Codex、API、未來 AI Agent 等服務的推論工作負載設計。
- 以推論效率為核心:主要目標是 提高 LLM 推論吞吐量、降低延遲,並改善每瓦效能,支援大規模互動式 AI 服務。
- 每瓦效能是主要指標:早期測試顯示 Jalapeño 的 Performance per Watt 高於當時最先進方案,但最終效能仍需完整技術數據驗證。
- 支援 Full-stack 最佳化:OpenAI 可從 模型、Kernel、記憶體、網路 一路延伸至晶片進行共同最佳化,以降低長期推論成本。
- 降低外部 GPU 依賴:自研推論 ASIC 可增加 OpenAI 對 算力供應、硬體架構 的掌控度,但並不代表完全取代 GPU。
部署規劃
- 2026 年底開始初期部署:Jalapeño 是 OpenAI、Broadcom 多世代運算平台的第一款晶片。
- 朝 GW 級規模擴展:後續規劃逐步部署至吉瓦級資料中心基礎設施。
- 推進 AI 基礎設施垂直整合:OpenAI 從 模型、應用 進一步延伸至 晶片、網路、資料中心,以降低推論成本,並提高算力供應的掌控度。