除了帕斯卡NVIDIA還要在自動駕駛和VR上發力
2023-03-05 13:37:51 來源:
(原標題:除了帕斯卡 NVIDIA還要在自動駕駛和VR上發力)
NVIDIA GTC2016如期進行,也該是NVIDIA秀實力的時候了,毫無懸念的是老黃在GTC大會上發布了首款基于帕斯卡核心的Tesla P100。但這不是GTC2016的全部,他們已經將科技樹點擴展到VR和自動駕駛領域,針對VR優化的Quadro M5500M顯卡、Drive PX 2自動駕駛平臺以及深度學習也同時登場,除了純粹的視覺計算之外,NVIDIA拿出了不一樣的玩法。
![]()
Tesla P100:核心競爭力
黃仁勛一上臺自然先說基于Pascal的Tesla P100。Tesla P100基于16nm FinFET工藝打造,面積610平方毫米,晶體管達到了150億個,單精度性能提升到10。6TFlops,雙精度性能5。3TFlops,要知道上一代Maxwell的GM200的單精度也只擁有7TFlops,雙精度0。2TFlops,提升幅度幾乎讓人無法直視。
![]()
最頂級的GP100核心將同時擁有3840 CUDA核心,240個紋理單元,最高支持32GB HBM2顯存、位寬4096bit。不過Tesla P100則處于能耗考慮,提供16GB HBM2顯存,3584個CUDA核心,224個紋理單元,今年第四季度量產,但要等到明年第一季度才會上市。
![]()
玩家們可能要抱著GTX 980Ti再玩一會了,老黃發布的Tesla P100與游戲沒什么關系,Tesla P100屬于服務器級產品,事實上NVIDIA正在與IBM合作,通過NVIDIA GPU與OpenPOWER結合加速Watson的技術升級,NVLink GPU互聯技術將同時支持IBM Power架構和NVIDIA Pascal架構兩個部分,它能夠一次性鏈接8個Tesla P100 GPU,而IBM POWER8上已經有所采用。
![]()
按照黃仁勛的說法,NVIDIA對Pascal GPU架構進行了重新設計,相對于Maxwell解決方案,Tesla P100要在神經網絡訓練上將性能提升12倍。同時半精度指令甚至還提供了超過21TFlops的峰值性能。由于Pascal架構將處理器和數據封裝到一起,包含HBM2顯存在內的CoWoS設計方式,也正因為如此,它的顯存帶寬也達到了720GB/s,相當于Maxwell架構的3倍。
![]()
Tesla P100目的在于為AMBER 分子動力學程序代碼等一系列HPC和深度學習應用程序提供更快的速度,NVIDIA用48個雙路CPU服務器節點作為對比,無疑Tesla P100速度完勝,而在AlexNet深度神經網絡中,需要250個雙路CPU服務器節點才能比得上8個Tesla P100。而針對新平臺,NVIDIA SDK也將進行一系列更新,包括CUDA 8和cuDNN version 5深度神經網絡基元庫,方便工程師能夠在調配CPU和GPU之間運算的時候,提升CUDA運行效率。
![]()


















