单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s
合集 · AI系列 (21)
-
Unraid部署Deepseek-R1模型全攻略(含A卡、N卡加速以及纯CPU环境)
19:05
-
899元6年前矿卡逆袭!双卡AMD RADEON VII暴跑70B大模型!
12:17
-
以后用NAS只要“说”就够了?——通过AI🤖部署基于Ubuntu的“NAS系统”实战
38:27
-
垃圾佬狂喜!300块的CPU+600块的计算卡?组装能跑70B模型的AI服务器是种什么体验?(浪潮SA5212M5 + 3x MI50)
12:06
-
【AI垃圾王】2500元不到装一台AI服务器!双Radeon VII解锁vLLM张量并行,性能暴涨6倍碾压Ollama!
8:00
-
别被“AI”忽悠了!1999元的小米AI眼镜,是年轻人的新玩具还是新“智商税”?
20:22
-
我花了3700块,从闲鱼买了台双Tesla V100扩展柜,想一步到位玩转MoE,结果…
12:12
-
说句话就能自动找番下载?我把本地80B大模型调教成了“追番特工”!
12:44
-
单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s
17:53
-
从自动写代码到智能影音刮削:实测 OpenCode,这台“赛博管家”真的能干苦力活
16:56
-
不用买macmini!手把手教你在NAS(LINUX虚拟机)里安装Clawdbot/Moltbot
24:54
-
一键部署Openclaw还能白嫖算力?绿联NAS送你“小龙虾”!
5:40
-
拒绝黄牛加价!1300块拿下M1“无头骑士”,这才是平民最强“养龙虾”神器?
7:43
-
AI时代买了个“黑白屏”?数码老爹深度实测!
7:59
-
别再当韭菜!600块组装Mac mini平替,跑AI Agent比白苹果还香?
7:04
-
铭凡 N5 MAX 首发评测!这才是真正的AI(O) NAS!120W 满血释放,16核32线程,本地AiAgent + 本地视频生成
15:54
-
AMD核显实战ComfyUI:七彩虹灵创K16如何包揽全套本地AI视频制作
13:00
-
榨干最强蓝厂显卡!单芯片32G的铭瑄Arc Pro B70,跑大模型/AI视频有多猛?
16:48
-
能跑 DeepSeek-V4 的"无头骑士"迷你主机——极摩客 EVO-X3 实测体验
9:53
-
2026 年了,工作室的 AIO 服务器应该会干什么?
17:36
-
最便宜的32G正规军、但算力砍四成:Arc Pro B65 到底值不值这8999
6:10
Description
【简介开头:勾起好奇】 2025 年了,本地 AI 玩家最焦虑的不再是算力,而是显存。想跑 70B 级别的“真·生产力”模型,24GB 显存的 4090 都得低头。但这台 20L 的小机器,靠着一张单卡双芯、48GB 显存的“怪兽级”显卡,彻底打破了显存霸权。 【视频亮点:硬核总结】 本期视频带大家深度拆解并实测铭瑄 Intel Arc Pro B60 Dual 48G Turbo 显卡,以及与之匹配的铭瑄 Ai Micro Station(MS 275HX)准系统。 AI 算力: 实测 DeepSeek R1 70B 量化模型,单路生成稳定在 19 tokens/s,16 路并发总吞吐高达 226 tokens/s。 视频剪辑: 完美补齐 N 卡软肋,4K 4:2:2 10-bit 素材 6 轨并发流畅回放。 暴力逻辑: 在一张 PCB 上塞进两颗显卡核心,配合 PCIe 通道拆分,实现 48GB 超大显存池。 紧凑扩展: 20L 体积,支持 96GB(甚至最高 256GB)内存、PCIe 5.0 SSD、万兆网口与雷电 5。
Comments
这机箱的设计师,大概是真的疯狂,让我这个曾经爱好机箱的人都感觉年轻了十岁,又回到以前各种搭配DIY的日子
♥ 314 ↩ 9
qwen3 30b a3b 2507和glm4.7flash这种比老70b好用多了,或者qwen3next80a3,基于qwen2.5和llama3那一票70b搞的模型已经淘汰了
♥ 107 ↩ 26
1W块可以搞4个Quadro RTX 6000了,显存96G[doge],cuda生态可比intel好多了,哪怕是Turing这种老卡
♥ 117 ↩ 47
4000块可以搞4个NVIDIA Tesla T10了,显存64G[doge],cuda生态可比intel好多了,哪怕是Turing这种老卡(文案抄楼上的[妙啊])
♥ 92 ↩ 26
2026年了还在用DeepSeek 70b这种说法
♥ 81 ↩ 4
别测r1 distill了,这玩意太拉了,可以测点glm4.7 flash这种
♥ 78
如果说这个主机的俩 x16 插槽都是 x4,x4,x4,x4,那就可以插两张 b60 了,96g 超大显存。 我有个问题啊,B60 这种 GPU 似乎是没有类似 nvidia nvlink 这样的功能的,双芯之间的通信不是直连,而是要过 cpu 的,这能认为它们之间的通信对大语言模型推理有显著加速作用吗?一般来说,多卡情况下,只能把显存分摊到不同的 GPU 上,运行效率只有单卡速度(比如插双卡,每个卡占用就 50%,插三卡,每个卡占用 33%),除非是有 nvlink 这样的互联技术,然后开启什么张量并行才能充分利用多个核心,B60 支持相关技术吗? 我觉得不支持,所以我写在弹幕里了
♥ 61 ↩ 25
讲个笑话,这卡显存带宽456GB/s[吃瓜]
♥ 100 ↩ 42
省流12999
♥ 54 ↩ 3
我在体验了mac M1pro 32GB部署32B千问模型之后,觉得mac包括mac mini等设备,真的很适合玩本地部署。相比于显卡方案,价格还真挺有优势。而且后面不想玩了,卖二手也方便
♥ 47 ↩ 28
可以在京东找个运营几年的店铺,买两张3090并联了,生态支持和性能都比它要更好。 至于说耗电量,我想说的是:你都需要两张3090干活了,别跟我说你的收益还覆盖不了电费。
♥ 26 ↩ 2
其实不一定需要主板原生支持拆分,可以通过短接CPU针脚的方法来拆分https://www.bilibili.com/read/cv16530665, 2)如果BIOS中有PCIe拆分选项,千万不要用短接CPU触点的方式硬改。会造成BIOS设置项与实际信号不一致导致自检冲突,无法通过自检,Debug亮CPU故障灯。
♥ 24 ↩ 2
设计挺用心的,13000的话也不错了,毕竟是小机箱,那么多背插的特殊设计。 DIY平替可以买265k+铭瑄z890pacific,一样是2条pcie5.0x16(x8)插槽,第一条x16也可拆分x8x8或者x8x4x4,也有1个sff8654+4sata接口,4个内存槽。 11月刚照着Puget workstation C121-L 5000美刀的型号配的,花了1万出头 https://www.pugetsystems.com/products/workstations/core-ultra/c121-l/ intel u7 265k+铭瑄z890太平洋 pdd套装3150元 酷冷hyper612单塔 jd320元 Crucial ddr5 5600 128g 美亚2500元 Samsung 990pro 4tb jd 2600元 Fractal Design define7c 咸鱼500元 台达1100w jd1050元 tplink aqc万兆网卡 咸鱼200元 俩14cm风扇rog 4pin pdd 57元 合计10400 5600内存可以保持1.1v不加压跑6400 很稳定,aida64火力全开稳定性测试8小时无报错。
♥ 22 ↩ 3
?1W3我买这个?
♥ 21 ↩ 9
这个准系统比这张双芯片卡有意思多了
♥ 20
显存不缺,缺内存…[保卫萝卜_哇] 太贵了
♥ 16 ↩ 1
前两天跟厂家聊天,据说有厂家已经改出64G的5090了。只是BIOS还不稳定,还在调[doge_金箍]
♥ 12 ↩ 3
1.一万多,不过显存给的确实够,专业软件有认证,算是黄金一样的专业制图卡里性价比拉爆的了。 2.I卡要注意一个问题,如果你的视频线插mtl以前的核显上且不准备放弃核显性能的话,新的N卡驱动将不再同时支持核显。表现为打好独显驱动以后饱和度瞬间爆炸且无法在显卡驱动中设置。 解决办法是先打独显驱动,然后打一个最新的核显驱动,打的时候把“进行全新安装”等可能删除旧驱动的选项关闭,这样就可以实现核显用核显驱动独显用独显驱动。 代价是可能得部分放弃oneapi。
♥ 12 ↩ 1
可惜了,这个机箱应该测2张B60 48G的,70B Dense模型没人会用的,能跑的起70B的模型的配置都会去跑MoE的Qwen3-30B-A3B-2507系列、Qwen3-Next-80B-A3B系列和GLM-4.7-Flash系列。 AI方面再测下Comfyui下Wan 2.2系列、LTX-2系列跑5秒 1秒15帧 720p分辨率规格的视频要多久,以及Z-Image-Turbo 生成2k分辨率的图速度就好了。
♥ 11 ↩ 4
问了吗
♥ 10 ↩ 1