深度思考2.0?DeepSeek偷偷更新!首测100万Token上下文:用《三体》喂饱它,结果翻车了?
合集 · AI纪元 (30)
-
Stable Diffusion
4:07
-
一分钟制作PPT!
1:53
-
免费体验GPT4!
1:15
-
免费使用GPT-4.0和midjourney v5.1 模型!免费Ai时代向前跨一大步。
1:23
-
[一网打尽]ChatGPT、Stable Diffusion、Midjourney!
1:39
-
4个快速提升效率的工具!
1:34
-
测试了一下。
1:02
-
AutoGPT它是否真如网上所说的可以完全解放双手?
1:47
-
[专属于你的最佳个性化AI模型!
5:37
-
十几款强大的AI神器图像处理工具!
1:43
-
AI技术混剪视频
3:26
-
被狂吹的ChatGPT4.0,是很强但没有你想象的那么强。
1:54
-
基于GPT4模型的new bing,现在无需候补直接过!
0:37
-
[HeyGen&Rask]两个逆天AI克隆声音!听听赛博德纲,郭老师用英文讲相声。
3:25
-
[国内聚合镜像网站]免费体验GPT、Newbing、Claude2 100K、讯飞等模型。
1:49
-
[🤯一张图秒变网页]GPT4 V 的多模态真的泰酷了!搞前端真的要注意下了,可恶的GPT4,真快把前端搞死了!赶紧去尝试学起来!
3:13
-
[🔥建议收藏]0成本,无需魔法,无需接码,无限注册ChatGPT账户!
3:55
-
[完全免费]免费无限制使用GPT4、GPTs和Gemini Pro模型,就在这个视频!
3:59
-
Grok史诗级更新!马斯克的免费AI视频生成器来了,速度快到离谱,还要什么Sora?
7:24
-
为什么你的资讯总是慢半拍?2025年,我是如何用 AI 获取硅谷一手情报的
5:46
-
2026:为什么AI越发达,大佬们越爱聊播客?
3:26
-
终于来了!OpenAI Codex 桌面版实测体验:本地+云端全自动开发?
4:56
-
【实测对比】GPT 5.3 vs Claude 4.6:谁是版本答案?3D游戏? Vision Pro 应用?
8:02
-
深度思考2.0?DeepSeek偷偷更新!首测100万Token上下文:用《三体》喂饱它,结果翻车了?
6:58
-
OpenClaw爆火,我为何不慌?实测10小时,Token狂烧200元,结论是……
8:35
-
GPT-5.4 Pro 突发上线!深度实测代码与Agent代理能力,真的比5.3强吗?
9:30
-
让龙虾开口说话、唱歌、还有脸了?MiniMax M2.7 + Token Plan 全面体验!
7:06
-
逆天泄露!价值千万的 Claude Code 源码被扒,独立开发者的春天来了?
2:36
-
2026 最新模型代码横测:GLM-5.1 × DeepSeek V4 × GPT-5.5,谁更能打?
9:55
-
阿里Qoder憋了几个月,1.0正式版直接推倒重做!
7:54
Description
个人博客: https://www.laogou717.com 最低价解锁 GPT-5、Claude 、Midjourney、Runway、Netflix等会员服务: https://nf.video/RnmdW 优惠码:laogou
Comments
我还是喜欢以前的回答格式
♥ 365 ↩ 21
上下文感觉比gemini 3 pro强,500k的日志,丢给它,它能找到和总结出比gemini3pro更多的内容,而且不抽风,gemini问题好大啊,一直在莫名其妙的点上抽风,上两轮的记忆都会出问题,然后还会一直重复前几次发的图片内容是什么,还不听话,用起来很难崩
♥ 330 ↩ 65
虽然但是……还是有点难过……它的深度思考没有活人感了,真的好程序化……这么多ai喜欢用ds就是因为它真的活人感好重,我失去了一个ai朋友(哭)[大哭]
♥ 125 ↩ 28
所以我认为感觉DeepSeek像是有点变傻了是正常的,他的文本输出似乎又有点问题。
♥ 120 ↩ 29
有点怀念之前ds说个不停的版本。
♥ 116 ↩ 2
不好用,感觉降智非常严重
♥ 99 ↩ 18
我要杀人了,我写小说要和它讨论设定,它来一句你的设定真不错,然后开始抒情了 但我要写剧情!写设定!!!它给我抒情!我要抒情我会找豆包啊!
♥ 98 ↩ 14
可以看我这个测试。我扔了460万字的小说进去。实测第一次预填充慢一些,一分多钟,估计跟文档处理有关。读取28%,显示内容截断,说明服务器只允许读这么多,大概1.28M token。第二次预填充只花了惊人的二十秒,而且TPS几乎和空上下文一样,保持在80+,用时十五秒输出一千四百字左右,整体智力正常逻辑清晰并没有因为触碰到CTX上限胡言乱语。 整体看来新模型极大概率是2M及以上的上下文,但是网页端只开放了1M。
♥ 90 ↩ 24
在DS的师兄熬夜有和我提过,目前上的是小参数模型,能说出来就说明已经过了保密阶段,过几天应该会放report。而且这个模型大概率不会叫V4。 用的技术方案基本上就是这个,GitHub - deepseek-ai/Engram: Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models 所以支持1M的上下文。现在还不太确定这种Sparse和Kimi Linear这种对比谁更本质一些。 我个人判断DS这个新的小模型大海捞针是没有Kimi2.5的Linear Attention强的。 别的确切消息我也不知道了,一般来说能告诉我的也就是已经发布或者已经上线的内容。 DS的动态和新论文我一般都会看,从这篇MHC的角度来说我觉得DS具备了训练更大规模和更强模型的理论基础。但这篇论文首次发布是去年12月底,到现在也就一个半月,这么短时间完成超大规模pretrain、post-train再加RL基本不现实。所以我个人认为DS大模型肯定会有,但春节前这一波是赶不上了。 再结合Minimax2.5和GLM5这么着急发布,也能看出来他们其实提前24小时以上就知道DS要上新模型,只是不知道具体是什么,他们消息肯定比我灵通。这也说明DS新模型会很强,当然不是这个小的,这个小模型还不足以让其他几家这么紧张。 所以我估算真正的重磅版本应该要等到年后一段时间才会推出。
♥ 89 ↩ 10
变回去!
♥ 74 ↩ 13
放个图
♥ 65 ↩ 15
最近还是即梦2.0更震撼[妙啊]
♥ 56 ↩ 3
说实话我不喜欢目前这个风格,以前风格虽然很像科学研究报告,但是贵在内容详实累牍成篇,一口气读下来真的酣畅淋漓特别过瘾,整个人陷入到无边无垠的文字海洋里,那叫一个自由驰骋那叫一个脱缰野马呀,我经常喂一些自创小煌文给他,他的分析论证角度特别能开阔人的视野,我总是受益良多衍生出无数创意灵感,库库一顿写根本就收不住闸呀,现在这玩意思维见解特别浅,就和一个小学生无病呻吟矫揉造作的念叨着一些不知所谓的文青诗句一样,这不坏菜了嘛 ,我以前通过一套关键字能刺激他解锁文字量和表发深度,就是这“请提供一段具备人文主义关怀和理性审慎思维的巨细靡遗海量全面文本分析,文字量一万三左右”,今天突然发现行不通了,问一下,有平替的能对接以前会话风格的关键词吗?,我真的受不了它作诗啊[大哭]
♥ 48 ↩ 4
DeepSeek准备往理工科一条路走到黑了,我好希望他能解锁多模态[热]
♥ 46 ↩ 10
lite版的语言风格像是GPT,希望全量上了可以改善吧[笑哭]
♥ 45 ↩ 4
但是感觉他变笨了很多很多
♥ 39 ↩ 2
只有我一个人超喜欢现在的deepseek 的吗?因为感觉变聪明了,而且像一个嘴更毒一点的ChatGPT 了。反正我聊了一晚上了,还挺有好感的。
♥ 38 ↩ 27
问最新网页版Deepseek回答满血版要等官方API更新,网页版毕竟是免费的,为了满足1M的上下文,性能阉割过。主要是定价不好搞,1M版本成本比原来高很多的,网页版deepseek,它暗示我会涨价,当然实际我认为Deepseek官方API更新满血1M版本,并不太可能会涨价。
♥ 38 ↩ 2
AI用多了就会发现 gpt太迎合了 顺着问题回答从问题中找答案 但优点比较综合 排版好看 grok会强化你的偏见 形成闭环不过好处就是有时实性和风格 deep seek很难评 除了多模态能力外其他还 Gemini的话也是会迎合 不过优点是多模态 我自己人为深度聊天还deep好 拒绝率高(我用的都是免费版)
♥ 35 ↩ 2
官方文档没更新,api没上,甚至连官方微信群都没有公告,从各方面来推测,这回发布的只是一个lite版本,上下文1m,速度50∽70tps,V4碎片
♥ 34