【OpenAI发布首款定制芯片 博通负责生产】近日,OpenAI发布了首款自研推理芯片,该芯片由其与博通(Broadcom)联合设计并代工生产。这款名为Jalapeño的处理器专为OpenAI推理系统的独特需求打造。OpenAI表示,公司自研AI模型也参与了这款芯片的研发工作(http://t.cn/AXSKhdB2)。
目前该芯片仍处于测试阶段,但OpenAI称初步测试数据显示,其单位功耗性能大幅优于当下市面上最顶尖的同类产品。
双方早在去年10月就正式官宣了这项合作,不过外界早已流传OpenAI自研芯片的消息,其核心目的是降低公司对英伟达GPU的依赖(http://t.cn/AXSKhdBA)。谷歌与亚马逊均推出过用途相近的自研芯片,这类芯片常被称作“AI加速器”,是专门为加速机器学习运算而设计的硬件。
在官宣与博通合作后不久,OpenAI总裁Greg Brockman在公司内部播客节目中,阐述了企业自研芯片的思路。
“我们对自身的业务运算需求有着深刻理解,”Brockman在节目中说道,“我们一直在挖掘那些现有芯片难以适配的特定运算场景,并思考该如何打造一款硬件,进一步释放AI技术的性能上限。”
Jalapeño芯片专为推理运算打造,推理指调用已训练完成的AI模型、响应用户指令的运算流程。OpenAI在发布公告中重点强调,该芯片运行实时代码模型时运营成本更低。像预训练这类对算力要求极高的任务,大概率仍需依靠英伟达硬件支撑;但即便只是小幅降低推理成本,也能显著改善公司盈利状况。
优化推理系统或将成为未来AI产业盈利模式的关键抓手,且软硬件全链路各层级都需要同步优化。OpenAI目前已在开发Codex等智能代理类产品及其底层大模型,同时自建配套数据中心承载模型运行。官方公告提到,自研专用芯片,能让公司在全链路优化上走得更深更远。
OpenAI表示:“公司不只是研发前沿大模型、基于模型打造应用产品,同时还在搭建底层全套基础设施:芯片架构、计算内核、内存系统、网络通信、任务调度、部署系统以及产品使用体验。正因为OpenAI掌握全栈技术,每一层软硬件都可以围绕同一个目标优化:让旗下模型运行速度更快、稳定性更强,同时降低用户使用成本。”
http://t.cn/AXSXKKyN
