01
「造芯」这件事,已成了一种潮流。
就在昨晚,OpenAI 公布了和博通联合自研的首款 AI 推理芯片 Jalapeño(墨西哥辣椒)首轮公开测试成绩。
在 SemiAnalysis 发布的公开基准测试 InferenceX 上,Jalapeño 运行了 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型,结果显示,Jalapeño 每瓦完成的 AI 工作比英伟达 GB200、GB300 多 1.5—1.9 倍,端到端延迟缩短至对照系统的约 30%—60%。
运行 DeepSeek R1 时,一次 8K 输入、1K 输出的推理从 5.99 秒降到 1.65 秒,最低 token 间隔则由 5.90ms 压到 1.43ms。
0
评论 (0)