硅谷看DeepSeek V4:模型效率、算力突围与AGI必经之路【硅谷101视频播客】
合集 · 人工智能专辑 (56)
-
ChatGPT与人类未来:AI茧房、安全漏洞与未知的社会形态|ChatGPT特辑(2)
31:31
-
ChatGPT这一战,科技巨头将重新洗牌【结尾有彩蛋🎉】|ChatGPT特辑 (1)
20:47
-
谷歌的人工智能有感知了?
19:05
-
特斯拉公布“擎天柱”新进展,AI机器人的ChatGPT时刻还有多远?
37:04
-
盘点2023上半年最耀眼的AI公司们,泡沫正在堆积吗?(上)
22:16
-
盘点2023上半年“卷上天”AI创业:VC资金疯狂批量砸出独角兽,科技巨头开启收购潮
21:58
-
四万亿美元增量机会,亚马逊云科技全面押注企业级生成式AI:更开放、更全面和更“俭约”
27:57
-
生成式AI这一年:从群雄混战到生态确立,世界已被改变 (送书福利)
32:33
-
从Sora展开,全面解读AI视频大模型发展史【深度】
35:00
-
各方大佬 “大打出手”:Sora是万众期待的“世界模型”吗?
15:05
-
英伟达GTC 2024: 绝对霸主的权力与遥远的野心
35:31
-
OpenAI与谷歌多模态重磅更新,生成式AI大战升级第二轮【硅谷101】
27:09
-
抢电、圈地、对赌,深聊科技巨头的千亿美元AI能源大战 【硅谷101】
30:21
-
揭秘疯狂“抢人”内幕 :硅谷AI精英人均“百万美元”薪酬,业界标配还是谣言?【硅谷101】
27:41
-
平庸且保守,但苹果或是AI落地的最大赢家【深度解读WWDC 2024】
32:07
-
震动的艺术:AI音乐大模型背后的技术突破、版权诉讼和资本蛋糕【硅谷101】
32:11
-
全球AI新范式:拼参数还是卷应用?从狂热回归理性
17:34
-
万卡集群的AI数据中心,到底是如何运作的?【硅谷101】
25:41
-
3nm AI芯片、上百模型、最大集群,亚马逊云科技全面加码AI生产力【硅谷101】
20:46
-
混乱、分裂、吞并:2024年AI的信仰之战【硅谷101】
44:29
-
硅谷视角深聊:DeepSeek的颠覆、冲击、争议和误解【硅谷101】
1:20:17
-
AI Agent爆发前的黎明:Manus不够好,但天快亮了【硅谷101】
48:45
-
“再造一个CUDA”:英伟达的第二护城河与“超级碗”阳谋【深度解析GTC 2025】
40:59
-
游戏是AGI的试验田?AI如何重塑游戏宇宙:探展2025全球游戏开发者大会
32:01
-
Google I/O 2025:搜索帝国的自我革命与AI翻身仗【硅谷101】
21:45
-
AI语音克隆进入“零样本”时代?解析TTS模型四大流派与问鼎榜首的MiniMax【硅谷101】
33:11
-
通往AGI的“敲门砖”:全栈能力才是AI真实价值?【硅谷101】
30:49
-
从“写诗”到“干实事”:“AI同事”是如何炼成的?【硅谷101】
25:57
-
“幽灵光标”爆发在即?从OpenAI杀入通用AI Agent,看懂下一个万亿流量之战与四大技术流派【硅谷101】
21:55
-
深聊GPT-5发布:过度营销的反噬与AI技术突破的困局【硅谷101】
36:21
-
Nano Banana爆火背后,深聊谷歌多模态五大主线布局【硅谷101】
25:39
-
走出硅谷,看看国际贸易的“ChatGPT时刻”【硅谷101】
17:24
-
Neocloud“云端对决”:一场举债扩张下的AI高风险进击
37:30
-
1024探班雪球:AI+鸿蒙,如何让投资更简单?【硅谷101】
9:45
-
谁是AI之王?聊聊备受争议的AI评测与崛起的LMArena【硅谷101】
23:11
-
给AI一个“身体”:3D数字人或是具身智能的解法?【硅谷101】
29:16
-
微表情测谎、极速赔付、AI打败AI,深聊“AI in All”下的保险革命与增长飞轮【硅谷101】
23:47
-
AI最烧钱的战场:数据中心的真实账单【硅谷101】
17:43
-
AI云端狂想曲:亚马逊云科技的算力突围、Agent重构与卓越运营【硅谷101】
33:52
-
阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】
24:37
-
寻找“贾维斯”:AI将如何重塑汽车、云与人的关系【硅谷101】
34:08
-
探展CES 2026:汽车开始“读懂”世界与Physical AI的“GPT时刻”【硅谷101】
35:35
-
CES 2026:探展50个AI项目背后的泡沫、野心与非共识【硅谷101】
40:06
-
为何顶尖AI公司都盯上游戏?【硅谷101】
14:56
-
全面解析“世界模型”:定义、路线、实践与AGI的更近一步【硅谷101】
49:36
-
GDC观察:游戏大厂都来聊AI,“游戏AI”的新规则由谁制定?【硅谷101】
21:51
-
2026英伟达GTC:“推理之王”的ASIC反击战与Token经济学【硅谷101】
28:05
-
AI救活了一家马桶公司,也点燃了存储芯片超级周期【硅谷101】
39:08
-
智能体社交革命:AI Agent是怎么来到你我身边的?【硅谷101】
44:45
-
硅谷看DeepSeek V4:模型效率、算力突围与AGI必经之路【硅谷101视频播客】
1:11:00
-
“AI弃子”CPU逆风翻盘:英特尔、AMD与ARM意料之外的一场胜利【硅谷101】
9:42
-
库克的离场,苹果新AI权力重构与价值观天平|WWDC26【硅谷101】
43:07
-
Tokenmaxxing后的理智与Agent落地|探展亚马逊云科技中国峰会【硅谷101】
35:02
-
算力革命与云厂商三重进化:Agent云的架构升级与"度量衡革命"【硅谷101】
26:14
-
用AI寻找下一个“哈兰德”,为什么没能成为大生意?【硅谷101】
24:48
-
“榨”出硅的极限:怎么让GPU不“闲着”?【硅谷101】
28:48
Description
DeepSeek V4发布之际,正值OpenAI GPT-5.5、Kimi K2.6发布,Google官宣新一代TPU,以及Anthropic新融资消息同时出现。 AI行业再次进入高强度博弈阶段。但这一次,竞争的焦点正在发生变化:随着步入Agentic时代,效率成了智能的一部分。 这期视频,我们从硅谷视角,与两位资深嘉宾深度探讨了一个关键问题:为什么token efficiency(词元效率)正成为AI的核心指标?DeepSeek V4带给硅谷什么新的压力与启示?当开源模型为闭源巨头画下“死亡线”,大模型商业模式将迎来如何冲击?而英伟达主导的算力体系还能稳固多久? 采访嘉宾: 肖志斌:ZFLOW AI创始人&CEO、华美半导体协会前主席与董事会顾问 Jenny Xiao:OpenAl前研究员、Leonis Capital 合伙人
Comments
发布第一时间就接入Claude Code,然后就是48小时内三次降价。pro调用2.5折(5.6日活动结束),紧接而来就是flash&pro缓存命中1折,然后又宣布延长pro折扣时间(5.31到期)。 最大感受就是,梁文峰真的希望所有人都能用上最大最好的模型[脸红]如果不是首发手速快,都用不上原价模型了[藏狐][藏狐]现在调用API我都不看开销了,实在是太便宜了[笑哭]
♥ 788 ↩ 57
DeepSeek V4水平接近Opus 4.6,但价格只有十三分之一(按最近下调的价格计算)
♥ 406 ↩ 35
DeepSeek是用英伟达芯片训练的... v4英文版技术报告写得很清楚,报告16页,20页提到的TCGenO5、MegaMoE²等等几个相关算子,是只有CUDA上才有的,在华为昇腾上压根就没有相关适配。 而且v4Pro模型是mxFP4+FP8混合精度框架,模型的权重记忆、CSA索引、MoE等等基于FP4精度进行的训练,而昇腾卡还不支持FP4训练。按华为规划,最快最快 要等到年末的950DT发布,才能实验性支持FP4训练。 目前还只是在推理框架上用了昇腾芯片,没直接对外开放英伟达框架。 另外再梳理下,DeepSeek V4 Pro 的完整训练全阶段都是在英伟达显卡上进行的。在小尺寸模型(例如 V4 Flash)上,后训练的部分阶段尝试使用了华为的昇腾计算卡。 目前哪怕是华为进行的宣传,也只宣传了 Flash 尺寸模型在续训阶段能使用到昇腾卡。这一点,结合此前关于训练稳定性的一些传闻也可佐证
♥ 289 ↩ 16
DSV4pro用一整天只花2.7的含金量,感觉梁圣下半年又可以找借口永久降价了。
♥ 176 ↩ 14
[doge]
♥ 103 ↩ 3
deepseek啥时候能支持多模态呢,只能识别文字,感觉用起来还是有点局限性
♥ 77 ↩ 22
ds牛逼
♥ 101 ↩ 7
开源的优势就在于压路机,任何不如你还闭源的模型都会在商业上被单方面压扁。[笑哭]
♥ 56
记得去年刚出来的时候让英伟达一天跌了百分之17跌到118,那个时候Deepseek出来都说AI不需要那么大的硬件投入了,结果一年多过去了涨的最好的还是AI硬件,英伟达涨了快一倍
♥ 60 ↩ 7
这缓存命中率,伟大无需多言!
♥ 56 ↩ 8
这么高质量的频道,为什么评论区滞涨那么多[微笑]
♥ 48 ↩ 5
我想问问国内的这几个什么千问,deep seek,还有豆包,还有一些其他的百度啊之类的,包括夸克,我不知道里面有没有是一家。你们觉得哪个相对好用一点?我自己日常全都是deep seek。因为之前我有一个问题,问过几家的AI我个人感觉deep seek的回答是比较完善的,而且非常简洁,没有任何其他的冗余的东西。包括现在出了一些专家模式什么的,感觉回答还是相对来说比较可靠。但是你懂的,这东西用多了,你就会发现他也会说些乱七八糟的话而且有的但是你懂的,这东西用多了,你就会发现他也会说些乱七八糟的话,而且有的时候为了顺了你的意思,他会肯定你的说法,即使你的说法是有很大的问题的。
♥ 53 ↩ 16
价格便宜,性能不差,配置要求不高,老外不傻,知道怎么选。
♥ 80
我准备了两套说辞[doge_金箍]
♥ 78 ↩ 2
大概是半年前吧,也是真事,我在家躺着,突然感觉到肚子很饿,然后我就起床,一打开冰箱,拿了包方便面和两个鸡蛋,几条菜心,煮了包面,吃饱了就不饿了。[妙啊]
♥ 46 ↩ 3
deepseekv4没有glm5.1能力强,真说国产今年最惊艳的是qwen3.6 27b,又小又猛,本地部署强无敌。
♥ 60 ↩ 52
程序员表示dp的代码能力很差。其他的没有试过
♥ 37 ↩ 18
(=・ω・=)
♥ 39 ↩ 2
lmarena双盲coding实测
♥ 56 ↩ 28