一拳两个哈哈怪 2025-03-15 软件上也有很大的区别。 GPU 里面自带了调度器,SM 内部有 warp scheduler,整个 GPU 上还会有一个全局调度器。全局调度器一般跑在 CPU 上,比如英伟达的 GPU 会集成至少10颗 NV-RISCV 核心,这些 CPU 不运行用户代码,只用来做调度。 而 NPU 则没有自带的调度器,完全依赖 AI 编译器来预先安排好整个程序的执行流程。AI 相关的计算一般不涉及复杂的控制流,甚至运算次数都是固定的,所以静态规划是可行的。有的 NPU 上也会有 CPU,一般可以运行用户程序,用来做 dataloader 之类的。 ♥ 52 ↩ 12
_zhishu_ 2025-03-14 孙哥,关注你好多年了,请教一下未来领域的图像处理架构会不会变成GPU ➕NPU,我是做智能座舱那部分的,刚入职半年(从MCU开发转战图形图像了[doge]) ♥ 44 ↩ 7
少师夜雨 2025-03-14 现在的AMD以及Nvidia GPU都有Tensor单元了,不仅规模更大吞吐量更高,并且支持的数据类型更广,侠义npu就一小丑,除了低功耗啥也不是[吃瓜] ♥ 64 ↩ 13
ChenWeiCheng2002 2025-03-15 一堆看到华为npu就在喷的...挺无语的 你要谈科技领域,在国内你绝对避开不了华为的 它又不是只干手机!主业是基站跟大数据(云计算)方面,没被制裁前在神经网络这块还被nvidia说是一个很大的威胁呢! 现在的npu一般都是做推理运算,用在嵌入式上居多 还有一个tpu 其最大差异我认为是功耗方面,当然做的任务也是不一样不过功耗是差距最明显的 Tpu的工作就好比nvidia的tensor core,功耗比npu高很多 像最新的intel处理器不就加了个npu吗,那玩意功耗没有tpu来的高 Npu最大优势是在低功耗就可计算 像手机呀pc的cpu都是塞npu,这玩意功耗低非常适合用在移动端上面以及cpu上面(cpu积热严重你再加一个功耗大的进去那绝对被喷死) Npu的任务基本上都已经被预先设计好只需要套公式即可,像解码就是一个 Intel cpu里面的npu我记得可以在剪辑视频时候辅助解码编码 ♥ 59 ↩ 24
坐睡船自流云深一蓑小 2025-03-16 npu=not processor unit,因为它的唯一作用就是宣传的时候可以大大方方加上AI电脑,让总的tops看起来更高,实际没啥卵用[滑稽] ♥ 29
专注dotnet开发 2025-03-14 不用解释这么复杂,npu就是tensor core,tensor core就是npu。本质是传统gpgpu或cpu的历史负担太重,做矩阵乘法硬件效率不如专用asic电路。比如gpgpu采用simt也因为顶点和像素着色器编程模型就是simt,并不是一开始就为了做ai时代的矩阵乘法。 ♥ 48 ↩ 7
国社君神安暗黑德勒兹 2025-03-14 华为的npu里面塞了ai cpu,vector core,cube core,这个才是和npu概念最接近的设备吧,毕竟神经网络处理器不能自己完成整个神经网络的计算也不太合适。 ♥ 9
Pc_Feng 2025-03-15 NV GPU里面的tensor核心就相当于NPU,但是tensor核心只是NV GPU里面的一小部分,大部分的面积还有传统的CUDA核心和图形计算相关的单元。别以为NPU有多先进,他是只能运行某些特定运算的处理器,很多公司能做NPU,但是GPU就只有少数几家 ♥ 8
Comments
简单说就是GPU更通用,更灵活, NPU更专用,更快速, 老师动画很用心
♥ 449 ↩ 43
我就没见我的NPU跑过[无语]
♥ 135 ↩ 22
说白了就是把原本需要用软件处理的内容用硬件实现,代价是通用计算能力下降
♥ 64 ↩ 5
软件上也有很大的区别。 GPU 里面自带了调度器,SM 内部有 warp scheduler,整个 GPU 上还会有一个全局调度器。全局调度器一般跑在 CPU 上,比如英伟达的 GPU 会集成至少10颗 NV-RISCV 核心,这些 CPU 不运行用户代码,只用来做调度。 而 NPU 则没有自带的调度器,完全依赖 AI 编译器来预先安排好整个程序的执行流程。AI 相关的计算一般不涉及复杂的控制流,甚至运算次数都是固定的,所以静态规划是可行的。有的 NPU 上也会有 CPU,一般可以运行用户程序,用来做 dataloader 之类的。
♥ 52 ↩ 12
孙哥,关注你好多年了,请教一下未来领域的图像处理架构会不会变成GPU ➕NPU,我是做智能座舱那部分的,刚入职半年(从MCU开发转战图形图像了[doge])
♥ 44 ↩ 7
NPU比GPU快太多,也比CPU快更多,但是能做CPU的事情吗?
♥ 60 ↩ 34
现在的AMD以及Nvidia GPU都有Tensor单元了,不仅规模更大吞吐量更高,并且支持的数据类型更广,侠义npu就一小丑,除了低功耗啥也不是[吃瓜]
♥ 64 ↩ 13
[doge]然而搞笑的是在 llm 领域 npu 太专用,反而一点用都没
♥ 46 ↩ 14
gpu是cpu的补充,npu是gpu的补充。
♥ 63 ↩ 7
一堆看到华为npu就在喷的...挺无语的 你要谈科技领域,在国内你绝对避开不了华为的 它又不是只干手机!主业是基站跟大数据(云计算)方面,没被制裁前在神经网络这块还被nvidia说是一个很大的威胁呢! 现在的npu一般都是做推理运算,用在嵌入式上居多 还有一个tpu 其最大差异我认为是功耗方面,当然做的任务也是不一样不过功耗是差距最明显的 Tpu的工作就好比nvidia的tensor core,功耗比npu高很多 像最新的intel处理器不就加了个npu吗,那玩意功耗没有tpu来的高 Npu最大优势是在低功耗就可计算 像手机呀pc的cpu都是塞npu,这玩意功耗低非常适合用在移动端上面以及cpu上面(cpu积热严重你再加一个功耗大的进去那绝对被喷死) Npu的任务基本上都已经被预先设计好只需要套公式即可,像解码就是一个 Intel cpu里面的npu我记得可以在剪辑视频时候辅助解码编码
♥ 59 ↩ 24
npu=not processor unit,因为它的唯一作用就是宣传的时候可以大大方方加上AI电脑,让总的tops看起来更高,实际没啥卵用[滑稽]
♥ 29
不用解释这么复杂,npu就是tensor core,tensor core就是npu。本质是传统gpgpu或cpu的历史负担太重,做矩阵乘法硬件效率不如专用asic电路。比如gpgpu采用simt也因为顶点和像素着色器编程模型就是simt,并不是一开始就为了做ai时代的矩阵乘法。
♥ 48 ↩ 7
如果有一个几乎不具备图形计算能力的GPU(没有显示接口/光栅化硬件等)那它还能叫GPU吗
♥ 23 ↩ 9
现在的显卡不能叫gpu了,里面什么特种单元都有,包括gpu npu tpu一大堆
♥ 18
孙老师的动画是用啥制作的呀,看起来好精美[打call]
♥ 17 ↩ 9
通用的专用慢,专用快的不通用
♥ 18
华为的npu里面塞了ai cpu,vector core,cube core,这个才是和npu概念最接近的设备吧,毕竟神经网络处理器不能自己完成整个神经网络的计算也不太合适。
♥ 9
明显一般gpu更快,大多数soc的gpu规模比npu大的多[吃瓜]
♥ 11 ↩ 1
NV GPU里面的tensor核心就相当于NPU,但是tensor核心只是NV GPU里面的一小部分,大部分的面积还有传统的CUDA核心和图形计算相关的单元。别以为NPU有多先进,他是只能运行某些特定运算的处理器,很多公司能做NPU,但是GPU就只有少数几家
♥ 8