DeepSeek-OCR深度解读+上手指南!高精度表格、公式、CAD图字符&语义混合识别,多模态PDF一键转化MarkDown!多模态混合DeepSeek实战
Description
DeepSeek-OCR新模来袭!仅需7G显存,本地部署运行最强开源OCR+多模态混合模型DeepSeek-OCR,表格+图片+CAD图纸高精度识别,多模态PDF到MarkDown一键转换! ✅置顶评论扫码加入【赋范大模型技术社区】,领【本视频完整资料】+【DeepSeek-OCR模型权重】,以及更多【多模态RAG系统开发实战教程】+无门槛技术交流,期待你的加入
Comments
之前在推上就看到很多it大佬转发DS的OCR,这个模型最强的就是以极低的成本进行高精度识别和推理,毫不夸张的说DS的每一次创新,都是对打破算力神话和AI普及有着重大意义。并且难能可贵的是ds全部开源,对整体AI行业发展引领作用是远超gemini和gpt的那些顶级闭源模型,现在AI行业真得感谢ds开源了[doge_金箍]
♥ 139 ↩ 4
3B小模型的识别率已经达到97% 人眼的识别率差不多是98.5%到99% 确实是个很好的发展方向。1万token的上下文转换为图像上下文可能仅需要512token 。
♥ 116 ↩ 9
我们换个话题聊聊吧
♥ 85 ↩ 40
关键是模型,国内没有,需要翻墙,可否分享之?
♥ 64 ↩ 17
最强大模型,没有之一
♥ 63 ↩ 18
这就是v4的前驱,可以用于压缩上下文
♥ 58 ↩ 9
表面上是OCR模型,实际上是文本压缩模型[吃瓜]
♥ 50
今天早上才在ds的github主页看到,那时候才几百的star,原来是新模型
♥ 25 ↩ 1
这个模型可以直接在官网用吗?
♥ 25 ↩ 9
汉字+deepseek-OCR 岂不是信息二次压缩[支持][支持][支持]
♥ 25 ↩ 7
OCR没啥值得说的,多模态也不新鲜,我唯一感兴趣的是光学压缩部分,这个OCR模型真的能10倍压缩纯文本而几乎无损吗?
♥ 24 ↩ 3
国产ai唯一让我眼前一亮的是豆包的图片处理能力
♥ 23 ↩ 10
ocr大部分都不是免费的吧,本地OCR精度又不好
♥ 19 ↩ 15
九天老师太快了
♥ 17 ↩ 3
哪里下载?
♥ 17 ↩ 4
安卓ai
♥ 17 ↩ 4
说实话用ds本体确实缺陷很多而且服务器经常断,但比如用腾讯元宝版本的还是很爽的字符输出特别快识图画图p图也和豆包差不多水平,反正我这边解数学和学雅思确实挺不错的比豆包和grok智商高一点不会莫名其妙轮回思考
♥ 16 ↩ 5
有点意思 看看文字公式混排,手写,竖排日语的识别率怎么样,如果很高的话生产力价值极大
♥ 16 ↩ 2
试了,windows系统搞不了,flash-attn的预编译包没法整,貌似的Linux系统[拥抱][大哭]
♥ 15 ↩ 15