DeepSeek-OCR深度解读+上手指南!高精度表格、公式、CAD图字符&语义混合识别,多模态PDF一键转化MarkDown!多模态混合DeepSeek实战

Description
DeepSeek-OCR新模来袭!仅需7G显存,本地部署运行最强开源OCR+多模态混合模型DeepSeek-OCR,表格+图片+CAD图纸高精度识别,多模态PDF到MarkDown一键转换!
✅置顶评论扫码加入【赋范大模型技术社区】,领【本视频完整资料】+【DeepSeek-OCR模型权重】,以及更多【多模态RAG系统开发实战教程】+无门槛技术交流,期待你的加入

Comments

苇草轻荡 2025-10-22

之前在推上就看到很多it大佬转发DS的OCR,这个模型最强的就是以极低的成本进行高精度识别和推理,毫不夸张的说DS的每一次创新,都是对打破算力神话和AI普及有着重大意义。并且难能可贵的是ds全部开源,对整体AI行业发展引领作用是远超gemini和gpt的那些顶级闭源模型,现在AI行业真得感谢ds开源了[doge_金箍]

♥ 139 ↩ 4

麦块德 2025-10-21

3B小模型的识别率已经达到97% 人眼的识别率差不多是98.5%到99% 确实是个很好的发展方向。1万token的上下文转换为图像上下文可能仅需要512token 。

♥ 116 ↩ 9

VTA8WE 2025-10-21

我们换个话题聊聊吧

♥ 85 ↩ 40

仁義中國 2025-10-21

关键是模型,国内没有,需要翻墙,可否分享之?

♥ 64 ↩ 17

修罗霸王烤花生 2025-10-21

最强大模型,没有之一

♥ 63 ↩ 18

哈儿9000 2025-10-21

这就是v4的前驱,可以用于压缩上下文

♥ 58 ↩ 9

欲言又止的喝茶黑龙 2025-10-21

表面上是OCR模型,实际上是文本压缩模型[吃瓜]

♥ 50

大空术士 2025-10-21

今天早上才在ds的github主页看到,那时候才几百的star,原来是新模型

♥ 25 ↩ 1

HansHuaaaaa 2025-10-20

这个模型可以直接在官网用吗?

♥ 25 ↩ 9

修了个仙人长 2025-10-22

汉字+deepseek-OCR 岂不是信息二次压缩[支持][支持][支持]

♥ 25 ↩ 7

只有归零者能救宇宙 2025-10-21

OCR没啥值得说的,多模态也不新鲜,我唯一感兴趣的是光学压缩部分,这个OCR模型真的能10倍压缩纯文本而几乎无损吗?

♥ 24 ↩ 3

世界第一上单选手TheShy 2025-10-21

国产ai唯一让我眼前一亮的是豆包的图片处理能力

♥ 23 ↩ 10

是清安呀呀 2025-10-21

ocr大部分都不是免费的吧,本地OCR精度又不好

♥ 19 ↩ 15

code秘密花园 2025-10-21

九天老师太快了

♥ 17 ↩ 3

cnxmouse 2025-10-21

哪里下载?

♥ 17 ↩ 4

刘頭仁 2025-10-21

安卓ai

♥ 17 ↩ 4

隔山水樵 2025-10-21

说实话用ds本体确实缺陷很多而且服务器经常断,但比如用腾讯元宝版本的还是很爽的字符输出特别快识图画图p图也和豆包差不多水平,反正我这边解数学和学雅思确实挺不错的比豆包和grok智商高一点不会莫名其妙轮回思考

♥ 16 ↩ 5

ST丰川集团 2025-10-21

有点意思 看看文字公式混排,手写,竖排日语的识别率怎么样,如果很高的话生产力价值极大

♥ 16 ↩ 2

猫猫是只萝卜特 2025-10-21

试了,windows系统搞不了,flash-attn的预编译包没法整,貌似的Linux系统[拥抱][大哭]

♥ 15 ↩ 15