OpenAI 自研推理芯片 Jalapeño 在能效比上表现卓越,其每瓦 token 吞吐量全面领先英伟达 Blackwell,并在特定指标上比肩 Rubin 架构。该芯片采用通用设计,通过软硬协同开发,仅用 16 个月完成流片,并利用内部增强版 Codex 自动生成高效内核,大幅降低了开发门槛。尽管目前仍处于工程样品阶段,且需在 AgentX 等复杂工作负载下进一步优化,但其在内存带宽、互联架构及编程模型上的创新,正逐步削弱英伟达 CUDA 生态的护城河。未来,该项目将重点攻克量产规模化及数据中心部署难题,旨在实现 100 兆瓦级的算力扩展,对现有算力市场格局构成显著挑战。
Outlines
Sign in to continue reading, translating and more.
Open full episode in Podwise
