OpenAI发布首款自研AI芯片Jalapeño:9个月完成流片,推理效率逼近理论极限

OpenAI发布首款自研AI芯片Jalapeño:9个月完成流片

OpenAI与博通(Broadcom)联合发布了Jalapeño——OpenAI首款自研AI推理芯片,标志着面向大模型推理的多代计算平台正式启动。

芯片设计与架构

  • 从零设计,专为大模型推理优化,非通用加速器改造
  • OpenAI基于对模型内部结构、推理内核、服务系统的深度理解设计芯片
  • 博通负责芯片实现、板卡/机架系统集成、高性能网络和量产
  • 架构亮点:减少数据搬运、平衡计算/内存/网络资源、将实际利用率逼近理论峰值

性能与测试

  • 工程样片已在实验室稳定运行ML工作负载,包括 GPT-5.3-Codex-Spark
  • 早期测试显示每瓦性能显著优于当前最先进水平
  • OpenAI硬件负责人Richard Ho:「Jalapeño能以接近硬件理论极限的效率运行最关键工作负载」

开发速度

  • 仅9个月完成流片——据称是高性能先进半导体中最快的ASIC开发周期
  • 速度归功于OpenAI与博通的深度协作,以及OpenAI直接使用自家AI模型辅助硬件设计

全栈战略

Jalapeño是OpenAI全栈基础设施战略的一部分,覆盖芯片架构、推理内核、内存系统、网络、调度部署到最终产品体验,目标只有一个:让模型更快、更稳定、更便宜

Greg Brockman:「世界正在转向算力驱动的经济。Jalapeño旨在让算力更充裕,让AI对个人和企业都更快、更可靠、更实惠。」

部署计划

  • 2026年底开始部署,扩展至吉瓦级数据中心
  • 合作伙伴包括微软等

来源:AITNT News(原文来自微信公众号「AI寒武纪」)

发表评论