来客网

NVIDIA Tesla V100正式发布 5120个CUDA性能再翻1倍

声明:本文转载自 「evolife博客」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

老黄又曝核弹了!就在GTC2017的演讲上,黄仁勋正式宣布了基于下一代的Volta架构的Tesla V100,拥有5120个CUDA内核,16GB HBM2以及15TFLOPS的单精度性能,就连老黄自己都用了难以置信作为形容词。

文章配图

这块Tesla V100拥有12nm工艺,芯片面积为815平方毫米,高达210亿颗晶体管,内存带宽900GB/s。而Tesla V100的任务与P100相似,主要负责高性能运算和深度学习。在相同条件和数量下,Tesla V100能将性能提升1倍甚至更多,P100上原本需要20个小时完成的任务量放到Tesla V100只需要不到10小时。

文章配图

现场老黄制止不住自己的兴奋劲,一连演示了三个不同的DEMO。这块基于Volta的GV100内核现场怒艹Maxwell的Titan X,一点不给老显卡任何一点面子。于此同时,塞满Tesla V100的NVIDIA DGX-1主机也被同时发布,内置8张Tesla V100显卡,原本TITAN X需要8天完成的运算量在这个盒子面前被压缩到了8小时。

文章配图

同时基于Tesla V100推出的还有DGX工作站,采用4张Tesla V100,1500W功耗,自带水冷,售价69000刀,重点是面向深度学习工程师。在现场老黄甚至忍不住调戏了一下SkyLake,在大规模运算上的表现,Tesla V100比Intel的SkyLake快上15到25倍。

文章配图

文章配图

文章配图

更重要的是上述的所有产品不会只停留在PPT,产品会在今年第三季度问世,并在第四季度开始出货OEM产品。如果与Pascal时代相同,GV10x系列的GPU将有机会登陆消费级显卡,并且性能表现不俗。不知道现在还在考虑如何降价的A卡们,现在是个什么心情。

文章配图

评论 (0)