精读 预计 2 分钟
OpenAI unveils its first custom chip, built by Broadcom
摘要
OpenAI 公布其首款自研推理处理器 Jalapeño,由 Broadcom 参与设计与制造,专门针对其 AI 推理工作负载优化。该芯片仍处于测试阶段,但早期结果显示在性能 / 功耗比方面优于当前主流方案。该合作在此前已于 10 月对外宣布,同时也是 OpenAI 降低对 Nvidia GPU 依赖的一部分布局。文章提到 Google 与 Amazon 也已通过自研 AI 加速器芯片优化机器学习负载。 该芯片重点用于推理(inference)阶段,即运行已训练模型响应用户请求,尤其强调在实时编码模型上的低运行成本。作者指出,训练任务可能仍依赖 Nvidia 硬件,但推理成本的降低对整体经济模型影响显著。 OpenAI 管理层表示,公司在整个技术栈中协同优化,从模型、产品到芯片架构、内存系统、网络与调度系统,以统一目标提升模型速度、可靠性与成本效率。
荐读理由
Jalapeño 专为 inference 定制,可直接迁移到手头项目中用以降低成本;OpenAI 跨栈优化(kernels、scheduling、memory)提供可照搬的架构思路。
这条对你有帮助吗?