【芯观察】M1 Ultra GPU TLB 翻车? 内存子系统深度科普

合集 · 芯片技术 (37)

  1. 8:43
    M1 Pro|Max 性能分析: 拳打i9, 脚踢3080?
  2. 4:52
    【芯观察】M1 Ultra GPU TLB 翻车? 内存子系统深度科普
  3. 12:26
    【M1 Ultra】 大了又大的芯片, 背后到底用了什么技术?
  4. 6:35
    【堆料之王】Apple A15 全面解析: 系统缓存规模赶超6600XT
  5. 7:22
    14nm芯片叠加能超车7nm? 全自研28nm已经量产? 都是胡扯
  6. 8:12
    APU核显交火再现?CCD胶水故技重施?锐龙6000前瞻: 6nm Chiplets 加持, 16核秒Intel,核显追1650,交火秒3050
  7. 10:49
    【芯观察】ARM 要断气了?生态带头者要何去何从?
  8. 7:49
    【芯知识】英特尔12代小核提升不了续航?深入大小核架构与调度
  9. 8:03
    全新RDNA3架构要来了,6000系列值不值得上? AMD路线图+架构深度分析
  10. 12:38
    极客湾芯片能效测试方法不对, 还用错了算数平均? 聊聊能效分析背后的知识
  11. 11:54
    苹果没告诉你的秘密: M1芯片背后的PMIC, 在能效上发挥了什么作用?
  12. 10:34
    AMD自研架构换掉CUDA: 美国Frontier超算如何承上启下, 成为最强最高效的超算?
  13. 10:23
    【M2深度分析】牙膏挤得不多不少, 也是种技术 | MBA 配置解析
  14. 6:24
    【多大才够用?】内存深度科普: 从堆内存到虚拟内存管理
  15. 5:25
    极客湾又错了? M2功耗测试软件解析, 顺带再聊聊数据处理问题
  16. 9:00
    为啥安卓比iOS更吃内存? 从二进制/JVM到App框架设计全面分析
  17. 4:37
    RDNA3架构解析: 优秀的成本控制, 全面跟进的图形技术
  18. 10:02
    四倍性能提升, 追赶PS4/SD? 次世代Switch Orin芯片分析
  19. 9:26
    高通联发科真的超越A16了?聊聊性能量化分析方法, 以及跑分和真实体验的关联
  20. 8:52
    SD能连Switch游戏都能玩? 图形API发展/转译技术大科普
  21. 12:24
    手机平板芯片那么强了, 为何除了原神没有3A大作?
  22. 8:01
    叠了缓存, 但没都叠, 这咋调度? AMD 7950X3D 深度解析
  23. 5:45
    一年提升15-40%性能是什么体验? M2 Pro|Max 分析
  24. 4:29
    N3E青春版是3nm正统? N3B又是啥? 台积电3nm工艺x苹果芯片路线图分析
  25. 7:23
    什么显卡能让ChatGPT跑在本地? 计算卡语言模型性能需求分析
  26. 4:00
    锐评跑分软件Geekbench6: 不伦不类, 货不对板
  27. 8:03
    财报大亏损,服务器大翻车, 还被批评出货「半破坏市场」? 深度解读Intel22财报&研发
  28. 12:11
    拯救信号差,告别双层主板?苹果自研5G基带深度分析
  29. 20:22
    M1大量SWAP+内存压缩还不卡,pSLC让SSD更耐用? 苹果存储协处理器&内存压缩交换机制深度解析
  30. 11:49
    OPPO哲库为何光速解散?深度分析自研芯片失败症结
  31. 3:05
    内存能差两三倍? 两大平台/海内外App内存占用实测
  32. 14:54
    A17 Pro性能前瞻分析: IPC没变? 全靠提频?
  33. 8:58
    M3系列深度解析: 新智能缓存/光追架构, 生产力爆发?
  34. 17:40
    为什么「统一内存」是PC的未来? 从内存技术的瓶颈、芯片封装和HSA软件架构来分析
  35. 14:02
    美术榨干光追性能, 本世代最强实机画质: GTA6首发预告分析, PC显存危机?
  36. 13:46
    Apple R1深度解析: 不止是「信号处理器」
  37. 15:31
    安卓多两倍,推送服务少不了: 双平台/海内外内存占用大横评
Description
M1 Ultra 发布之后各路媒体都发布了自己的测试. 虽然依赖 CPU 多核的任务提升接近翻倍, 但是让人奇怪的是, 图形应用都有不同程度的性能损失.
前段时间有开发者找到了其中的原因: M1 Max GPU 的 TLB 规模不够大. 这导致对跌倒了更大规模的时候, 限制了性能的发挥. 今天给大家分析, 为什么会有这样的问题.

Comments

干啃 2022-04-20

懂的人能听懂,不懂的人恐怕听不懂

♥ 328 ↩ 16

zhiyuanzhaiw 2022-04-20

是否可以简单理解为:寻址缓存太小,而内存/显存太大,就找不过来了[doge]

♥ 327 ↩ 23

jiangtao9999 2022-04-20

看前面还以为是内存访问被胶水双路给 DDOS 了。原来其实是设计上根本没考虑会上大内存…… TLB 瓶颈我记得有个办法绕过就是换大表页。不知道 M1 软件层面能不能实现。

♥ 123 ↩ 11

龙齑 2022-04-20

其实不用说的这么复杂,问题就是应用软件没有优化支持apple gpu的tbdr架构,当然这好像也是tbdr首次登上桌面端,水土不服是肯定的,只能等后续软件自己优化……

♥ 59 ↩ 12

時間众筹委員会 2022-04-27

又想起了上学期计算机操作系统大题的恐惧[嗑瓜子]

♥ 32 ↩ 1

meteor1202 2022-04-20

所以M1最有性价比的是MAX?

♥ 23 ↩ 7

朴世罗的鼻头痣 2022-04-20

Luv老师,小而美评测还有几天?[doge]

♥ 19 ↩ 1

天堂的风s 2022-04-20

反正都是用户买单[doge]

♥ 13

诚实的小蘑菇 2022-05-02

我的理解是TLB太小,Miss rate上去了,每次都得去page table去一级一级的找physical address,不过这种难道是设计失误?不应该呀

♥ 12 ↩ 1

千彗白描iokeroxeya 2022-04-20

AMD在肥龙时代的TLB bug说的TLB就是这个吗

♥ 11 ↩ 4

LostCity失落之城 2022-04-20

听到tlb出问题第一印象是AMD的早期phenom

♥ 11 ↩ 2

葛朗台菲菲 2022-04-20

怎么不用英语了,你不是痛批现在简中圈的视频不加字幕就听不懂吗

♥ 8 ↩ 1

NoobGeek 2022-04-22

懂得都懂 不懂的都不懂[doge]

♥ 7

金山学姐 2022-04-20

摸鱼正好刷到[doge]

♥ 6

Mugi酱麦麦 2022-04-20

建议up主说明自己的本科和硕士专业和院校,曾经发表的论文,这样更加有说服力,毕竟up主现在做的是严肃科普。[崩坏3_点赞]

♥ 5 ↩ 3

StevePark 2022-04-20

各位进来复习408了[doge]

♥ 5

MiFans1326 2022-04-21

买的起max吗?还头头是道的分析起ultral[doge]

♥ 4 ↩ 1

弥恋真绯瑠 2022-04-20

复习一下csapp

♥ 4

Gatsbie 2022-04-20

计组复习课

♥ 4