899元6年前矿卡逆袭!双卡AMD RADEON VII暴跑70B大模型!

合集 · AI系列 (21)

  1. 19:05
    Unraid部署Deepseek-R1模型全攻略(含A卡、N卡加速以及纯CPU环境)
  2. 12:17
    899元6年前矿卡逆袭!双卡AMD RADEON VII暴跑70B大模型!
  3. 38:27
    以后用NAS只要“说”就够了?——通过AI🤖部署基于Ubuntu的“NAS系统”实战
  4. 12:06
    垃圾佬狂喜!300块的CPU+600块的计算卡?组装能跑70B模型的AI服务器是种什么体验?(浪潮SA5212M5 + 3x MI50)
  5. 8:00
    【AI垃圾王】2500元不到装一台AI服务器!双Radeon VII解锁vLLM张量并行,性能暴涨6倍碾压Ollama!
  6. 20:22
    别被“AI”忽悠了!1999元的小米AI眼镜,是年轻人的新玩具还是新“智商税”?
  7. 12:12
    我花了3700块,从闲鱼买了台双Tesla V100扩展柜,想一步到位玩转MoE,结果…
  8. 12:44
    说句话就能自动找番下载?我把本地80B大模型调教成了“追番特工”!
  9. 17:53
    单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s
  10. 16:56
    从自动写代码到智能影音刮削:实测 OpenCode,这台“赛博管家”真的能干苦力活
  11. 24:54
    不用买macmini!手把手教你在NAS(LINUX虚拟机)里安装Clawdbot/Moltbot
  12. 5:40
    一键部署Openclaw还能白嫖算力?绿联NAS送你“小龙虾”!
  13. 7:43
    拒绝黄牛加价!1300块拿下M1“无头骑士”,这才是平民最强“养龙虾”神器?
  14. 7:59
    AI时代买了个“黑白屏”?数码老爹深度实测!
  15. 7:04
    别再当韭菜!600块组装Mac mini平替,跑AI Agent比白苹果还香?
  16. 15:54
    铭凡 N5 MAX 首发评测!这才是真正的AI(O) NAS!120W 满血释放,16核32线程,本地AiAgent + 本地视频生成
  17. 13:00
    AMD核显实战ComfyUI:七彩虹灵创K16如何包揽全套本地AI视频制作
  18. 16:48
    榨干最强蓝厂显卡!单芯片32G的铭瑄Arc Pro B70,跑大模型/AI视频有多猛?
  19. 9:53
    能跑 DeepSeek-V4 的"无头骑士"迷你主机——极摩客 EVO-X3 实测体验
  20. 17:36
    2026 年了,工作室的 AIO 服务器应该会干什么?
  21. 6:10
    最便宜的32G正规军、但算力砍四成:Arc Pro B65 到底值不值这8999
Description
🔥【震惊!6年前的AMD“矿渣”显卡竟成AI神器?】🔥
💰当所有人还在抢高价N卡时,司波图带你在黄鱼捡漏899元RADEON VII!
⚡单卡狂飙 34.6 tokens/s 运行14B模型,双卡竟能以 18tokens/s 跑32B模型,甚至 10tps 硬刚70B量化!
💻 实测对比3080ti、4060ti:千元卡显存带宽 干翻4090? 🆚 HBM2显存+ROCM兼容性全解析!
⚠️矿卡风险、部署避坑、🐧Linux/Windows双方案实测,垃圾佬玩转大语言模型的 最强性价比攻略!
👉「点击看6年前旗舰卡如何吊打当代中端显卡!」👈

Comments

-老湿基- 2025-03-03

radeon VII, 当时三千多买的,10001¥卖的。收我卡的老哥说:至少你曾经拥有过它,而且以一个万里挑一的价格卖出去。

♥ 585 ↩ 34

小猪吹泡泡 2025-03-03

[doge]各位臭打游戏的别激动 r7只有显卡和手办两种形态 挂掉几乎没有维修的可能性

♥ 426 ↩ 18

丞相 2025-03-03

这卡hbm暴毙就g了

♥ 199 ↩ 2

魚竿玩家 2025-03-03

笑死,前年几百块收的特斯拉p40拿来玩画画,现在两千多出掉了哈哈哈

♥ 153 ↩ 19

花臂皮卡丘小男孩 2025-03-03

HBM又称一波全带走

♥ 136 ↩ 2

zhiyuanzhaiw 2025-03-03

Radeon VII无感,但当初售价20000+的Radeon Pro VII实在是给我馋哭了。在当初所有消费卡专业卡都在砍双精度的情况下,这玩意直接给保留了完整的1:4 FP64,再加上它的计算卡底子(毕竟也是AMD的初代AI卡HI100同款核心)以及HBM显存,它当时在科学计算模拟方面几乎是无敌的。 唯一的问题——主要是我们的问题——是它高达2w+的价格。不过这卡现在价格也下来了,前几天查淘宝好像有人不到4k在卖,而且这卡没啥矿,矿老板都去买当时的3090去了,那个要便宜得多。我觉得大家也可以去找找看。

♥ 135 ↩ 29

今天睡过头了吗 2025-03-03

为什么这么执着于本地跑个残血模型 效果既差又强制要显卡,不如整点在线大模型+本地RAG之类的个人知识库什么的更有用

♥ 104 ↩ 54

shibmoksan 2025-03-03

up还是给咱们来套高性价比跑满血671b的方案吧[吃瓜]

♥ 89 ↩ 36

落梦离轩_BD4XSL 2025-03-03

千元价位可以看下前阵子新到的大船tesla t10 16g,现在价格是1370,可以改2080ti公版涡轮散热,我改散热的时候发现pcb板式可以加显存改24G的,目前用来炼丹很不错,功耗也才150w

♥ 71 ↩ 23

安东熊AntonBear 2025-03-03

首先ollama双卡速度没有加成,需要用支持张量并行的vllm 其次linux推理环境配置用gpustack会方便很多,也能通过多副本直接对比不同框架性能 最后显卡通信带宽的问题,选择带plx芯片的主板会有非常大改善。比如华硕的x99-ws,这样卡间通信能直接走plx芯片

♥ 63 ↩ 6

林远一 2025-03-03

图哥你早说啊,我给你优惠[吃瓜]

♥ 51 ↩ 10

雷比尔大将 2025-03-03

我买这卡纯粹就是为了玩游戏,还有看中视频补帧毕竟是最后一代GCN架构的卡。买这张卡的时候应该是狗东最后一张XFX公版自营了。 最高有矿老板1.2W收我也没卖。 因为我把自己逼成矿工了,一张蕾7一张580,110算力半年时间挖了1.2W市值的ETH,刨去电费大概净赚7000多。目前靠币市赚了小1W大概有2W左右本金。 目前这张卡除了换过两组风扇(因为挖矿时候保证散热我都把风扇拉满3850转),还在正常服役中,玩玩网游单机足够了。

♥ 49 ↩ 3

赤诚热血 2025-03-03

猜对了,哈哈哈哈哈

♥ 37 ↩ 2

皮卡丘PIKACHUIM 2025-03-03

从16g的不稳定588换成了更不稳定的雷七[tv_doge]

♥ 30 ↩ 1

therealPY 2025-03-03

当年3600买的镭7,卖了8500,外带小赚了点eth,太值了[脱单doge]

♥ 27 ↩ 4

Wenaka 2025-03-05

看来很多人还是对本地部署一词有着莫名的执念,就算量化成傻子了也一定要用消费级硬件跑个不如在线api一根的残血模型,似乎本地部署了什么限制都没了,什么都更加方便了,然而在实际应用中的区别只不过是把base url换成127.0.0.1罢了[呆]说什么无需联网、隐私安全,对于个人用户来说都是莫须有的需求,人家api供应商一天成百上千万的请求,谁在意你的隐私[吃瓜]企业?企业有需求的早上服务器了还需要我们来操心?

♥ 17 ↩ 18

一个寂寞的路人 2025-03-03

UP,ollama对于双卡策略是将模型拆开两段,不能跑满双卡的性能(有一张再算的时候另一张在摸鱼),用那些什么张量并行的方案应该还能再快一点

♥ 17 ↩ 6

海拉鲁奥特曼 2025-03-03

不用看,又是一波涨价潮,之前惠普的800g3把贩子们涨爽了[doge]

♥ 17 ↩ 1

xjzxh12345 2025-03-03

VII要涨价了[doge][doge]

♥ 14 ↩ 3

黑喵小姐泽远喵 2025-03-08

挂个逆天@吞天鼠鼠 :《锐评为不如四张P102》《帕斯卡架构连张量核心都没有怎么并行》《P102 70B模型35Token每秒》 我这3090、2060、P104、P106、P10、M40、3070Ti、4080、4090都用过,你觉得我可能没对比过就说这玩意纯垃圾吗? 事实就是P字头、10和16系的帕斯卡架构除了卡皇P100之外都没有完整的FP16算力,全是软件驱动兼容的,缩水几十倍的算力,跑大模型自带巨大Debuff 而且P10X系列矿卡都被老黄恶意阉割过显示接口和PCIe通道,是从GPU内部阉割的 除了P106能补电容补到PCIe 1.1 x16通道,其他的都是x4,多卡超过三卡速度就下降到比单卡还慢 传统的多卡协作是接力式的,卡1算完自己的部分给卡2,一轮一轮传下去,速度等于单卡速度+传递“草稿纸”浪费的时间,这时候没有PCIe3.0x16还不算啥 张量并行指的是模型竖着劈开,各放一部分,全部都拉满一起算,多卡算力可以叠加,代价是直接把主板的PCIe吃满,卡和卡时刻都要互相核对数据,就P104和102那1.1x4的德行基本上就告别张量并行了 至于看价格就更爆笑了 600块钱的MI50,单卡16G的HBM显存,起手26.82 TFLOPS的FP16算力 你P102两张600块钱,单卡10G显存,FP16算力 168.3 GFLOPS,差160倍【注意单位是G,人家是T】,就加一起大了4G显存 你这70B模型35Token每秒,我双3090都不一定跑的出来,你确定你这速度不是扫描上下文的速度? 你要是2080Ti拖P10X能跑出这速度,你直接开源,人类感谢你

♥ 13 ↩ 4