OpenAI 公布其首款自研推理芯片 Jalapeño 的首批测试数据:在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型上,峰值吞吐下单位功耗产出的 AI 工作量是对比系统的 1.5 至 1.9 倍,端到端延迟低 1.7 至 3.6 倍,高交互场景性能高 2.1 至 4.1 倍。芯片额定功耗 700 瓦,实测持续功耗不高于 550 瓦。
该芯片由 OpenAI 与博通合作开发,对标基准测试中领先的英伟达 GB300,但未与刚开始出货的英伟达新一代 Vera Rubin 比较,也不用于模型训练。OpenAI 计划今年年底前在自有算力设施中部署该芯片,第二代已在深入开发,第三代正在设计。
OpenAI | Bloomberg
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel