来客网

JALAPENO芯片强势叫板英伟达GB300

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

OpenAI称其自研AI芯片Jalapeno在功耗效率和响应延迟上超越英伟达GB300,专攻推理场景,由Broadcom协助开发。该芯片700瓦低功耗实现高性能,旨在降低算力成本。OpenAI称其同时具备高吞吐量与低延迟,尤其适合大模型。但OpenAI无意完全替代英伟达,仍将维持多供应商合作。

OpenAI正加速推进AI芯片自研,旗下Jalapeno在关键基准测试中跑赢英伟达GB300,最快将于今年晚些时候投入实际使用。

8月25日,据彭博,OpenAI表示,Jalapeno在单位功耗可处理的AI工作量和响应速度两项指标上均领先英伟达GB300。该芯片由OpenAI与Broadcom合作开发,主要用于支撑AI模型推理,有望帮助OpenAI降低对外部芯片供应商的依赖。

与传统芯片往往需要在吞吐量和延迟之间取舍不同,Jalapeno同时具备高吞吐量和低延迟性能。OpenAI芯片负责人Richard Ho表示,该芯片在700瓦低功耗下即可实现强劲性能,有助于降低数据中心的电力成本。

不过,OpenAI并未将Jalapeno定位为英伟达芯片的全面替代品。Richard Ho表示,OpenAI对算力的需求极为庞大,未来一段时间仍将与多家供应商合作,英伟达也仍是重要合作伙伴。

与此同时,第二代Jalapeno已进入较成熟阶段,第三代芯片也已启动概念设计,OpenAI正试图通过自研芯片进一步压低AI基础设施成本。

测试表现:两项指标超越英伟达GB300

根据OpenAI使用公开基准测试系统进行的评测,Jalapeno在功耗效率和响应延迟两个维度均优于英伟达GB300,后者是该测试系统中排名最高的产品。

Richard Ho在采访中表示,Jalapeno在高吞吐量领域表现突出,意味着能够以更低成本服务更多用户;同时,其低延迟表现同样出色,对于注重响应速度的客户而言,可以显著缩短响应时间。

OpenAI使用旗下一款小型开源模型,以及来自DeepSeek和月之暗面的第三方模型对芯片进行了公开测试。其中,Jalapeno在月之暗面旗下Kimi模型上的优势最为明显,该模型也是测试中规模最大的模型。内部测试显示,该芯片在运行OpenAI尚未发布的多款大型高阶模型时同样表现良好。

OpenAI在博客中指出,这表明该芯片的设计“随着工作负载增大和复杂度提升而愈发体现其价值”。值得注意的是,此次测试并未纳入英伟达最新一代芯片Vera Rubin,该产品目前刚刚开始出货。

0

评论 (0)