【芯观察】M1 Ultra GPU TLB 翻车? 内存子系统深度科普
合集 · 芯片技术 (37)
-
M1 Pro|Max 性能分析: 拳打i9, 脚踢3080?
8:43
-
【芯观察】M1 Ultra GPU TLB 翻车? 内存子系统深度科普
4:52
-
【M1 Ultra】 大了又大的芯片, 背后到底用了什么技术?
12:26
-
【堆料之王】Apple A15 全面解析: 系统缓存规模赶超6600XT
6:35
-
14nm芯片叠加能超车7nm? 全自研28nm已经量产? 都是胡扯
7:22
-
APU核显交火再现?CCD胶水故技重施?锐龙6000前瞻: 6nm Chiplets 加持, 16核秒Intel,核显追1650,交火秒3050
8:12
-
【芯观察】ARM 要断气了?生态带头者要何去何从?
10:49
-
【芯知识】英特尔12代小核提升不了续航?深入大小核架构与调度
7:49
-
全新RDNA3架构要来了,6000系列值不值得上? AMD路线图+架构深度分析
8:03
-
极客湾芯片能效测试方法不对, 还用错了算数平均? 聊聊能效分析背后的知识
12:38
-
苹果没告诉你的秘密: M1芯片背后的PMIC, 在能效上发挥了什么作用?
11:54
-
AMD自研架构换掉CUDA: 美国Frontier超算如何承上启下, 成为最强最高效的超算?
10:34
-
【M2深度分析】牙膏挤得不多不少, 也是种技术 | MBA 配置解析
10:23
-
【多大才够用?】内存深度科普: 从堆内存到虚拟内存管理
6:24
-
极客湾又错了? M2功耗测试软件解析, 顺带再聊聊数据处理问题
5:25
-
为啥安卓比iOS更吃内存? 从二进制/JVM到App框架设计全面分析
9:00
-
RDNA3架构解析: 优秀的成本控制, 全面跟进的图形技术
4:37
-
四倍性能提升, 追赶PS4/SD? 次世代Switch Orin芯片分析
10:02
-
高通联发科真的超越A16了?聊聊性能量化分析方法, 以及跑分和真实体验的关联
9:26
-
SD能连Switch游戏都能玩? 图形API发展/转译技术大科普
8:52
-
手机平板芯片那么强了, 为何除了原神没有3A大作?
12:24
-
叠了缓存, 但没都叠, 这咋调度? AMD 7950X3D 深度解析
8:01
-
一年提升15-40%性能是什么体验? M2 Pro|Max 分析
5:45
-
N3E青春版是3nm正统? N3B又是啥? 台积电3nm工艺x苹果芯片路线图分析
4:29
-
什么显卡能让ChatGPT跑在本地? 计算卡语言模型性能需求分析
7:23
-
锐评跑分软件Geekbench6: 不伦不类, 货不对板
4:00
-
财报大亏损,服务器大翻车, 还被批评出货「半破坏市场」? 深度解读Intel22财报&研发
8:03
-
拯救信号差,告别双层主板?苹果自研5G基带深度分析
12:11
-
M1大量SWAP+内存压缩还不卡,pSLC让SSD更耐用? 苹果存储协处理器&内存压缩交换机制深度解析
20:22
-
OPPO哲库为何光速解散?深度分析自研芯片失败症结
11:49
-
内存能差两三倍? 两大平台/海内外App内存占用实测
3:05
-
A17 Pro性能前瞻分析: IPC没变? 全靠提频?
14:54
-
M3系列深度解析: 新智能缓存/光追架构, 生产力爆发?
8:58
-
为什么「统一内存」是PC的未来? 从内存技术的瓶颈、芯片封装和HSA软件架构来分析
17:40
-
美术榨干光追性能, 本世代最强实机画质: GTA6首发预告分析, PC显存危机?
14:02
-
Apple R1深度解析: 不止是「信号处理器」
13:46
-
安卓多两倍,推送服务少不了: 双平台/海内外内存占用大横评
15:31
Description
M1 Ultra 发布之后各路媒体都发布了自己的测试. 虽然依赖 CPU 多核的任务提升接近翻倍, 但是让人奇怪的是, 图形应用都有不同程度的性能损失. 前段时间有开发者找到了其中的原因: M1 Max GPU 的 TLB 规模不够大. 这导致对跌倒了更大规模的时候, 限制了性能的发挥. 今天给大家分析, 为什么会有这样的问题.
Comments
懂的人能听懂,不懂的人恐怕听不懂
♥ 328 ↩ 16
是否可以简单理解为:寻址缓存太小,而内存/显存太大,就找不过来了[doge]
♥ 327 ↩ 23
看前面还以为是内存访问被胶水双路给 DDOS 了。原来其实是设计上根本没考虑会上大内存…… TLB 瓶颈我记得有个办法绕过就是换大表页。不知道 M1 软件层面能不能实现。
♥ 123 ↩ 11
其实不用说的这么复杂,问题就是应用软件没有优化支持apple gpu的tbdr架构,当然这好像也是tbdr首次登上桌面端,水土不服是肯定的,只能等后续软件自己优化……
♥ 59 ↩ 12
又想起了上学期计算机操作系统大题的恐惧[嗑瓜子]
♥ 32 ↩ 1
所以M1最有性价比的是MAX?
♥ 23 ↩ 7
Luv老师,小而美评测还有几天?[doge]
♥ 19 ↩ 1
反正都是用户买单[doge]
♥ 13
我的理解是TLB太小,Miss rate上去了,每次都得去page table去一级一级的找physical address,不过这种难道是设计失误?不应该呀
♥ 12 ↩ 1
AMD在肥龙时代的TLB bug说的TLB就是这个吗
♥ 11 ↩ 4
听到tlb出问题第一印象是AMD的早期phenom
♥ 11 ↩ 2
怎么不用英语了,你不是痛批现在简中圈的视频不加字幕就听不懂吗
♥ 8 ↩ 1
懂得都懂 不懂的都不懂[doge]
♥ 7
摸鱼正好刷到[doge]
♥ 6
建议up主说明自己的本科和硕士专业和院校,曾经发表的论文,这样更加有说服力,毕竟up主现在做的是严肃科普。[崩坏3_点赞]
♥ 5 ↩ 3
各位进来复习408了[doge]
♥ 5
买的起max吗?还头头是道的分析起ultral[doge]
♥ 4 ↩ 1
复习一下csapp
♥ 4
计组复习课
♥ 4