【开源】RAGFlow-OCR 毫秒级识别 CPU、GPU速度都很快,含整合包

合集 · 开源/免费项目 (30)

  1. 14:11
    Ultralight-Digital-Human 一个超轻量级、可以在移动端实时运行的数字人模型,赠整合包【开源项目】
  2. 8:19
    F5-TTS 一句话克隆声音,开源TTS,附赠Windows整合包,有兴趣的可以玩玩0.0
  3. 6:28
    Mini-Omni 一个开源的多模态大型语言模型,可以边听边说边思考。具有实时端到端语音输入和流式音频输出会话功能。
  4. 10:05
    【免费TTS】MultiTTS 安卓APP(Win电脑部署),可以提供API接口、用于听书等服务,提供在线搜集的语音包
  5. 23:38
    GraphRAG-Ollama-UI + GraphRAG4OpenWebUI 融合版,WebUI + API,提供win整合包,值得一玩喵【开源项目】
  6. 12:38
    FunAudioLLM-APP win整合包,ASR+LLM+TTS(sensevoice+dashscope+CosyVoice)【开源项目】
  7. 26:51
    Auto-GPT 手把手带你一起部署体验,我也是第一次用哈,懂的都懂
  8. 19:13
    MeloTTS 高质量多语言文本转语音,支持训练,提供API, 赠win整合包,类似bert vits2
  9. 7:11
    F5-TTS API服务,提供密钥鉴权能力,UUID参考音频文本管理,兼容AUTODL,为你的后端调用提供赋能,FastAPI+Swagger文档,轻松上手
  10. 7:43
    FunASR WS Win整合包,实时ASR,对接AI Vtuber和LiveTalking【语音识别 | 语音转文本 | 阿里 | 免费 |白嫖】
  11. 5:56
    LLama-Factory lora模型 调用API,OpenAI接口协议,为你的模型微调应用赋能 【LLM | Qwen | 模型微调 | 训练 | API】
  12. 2:49
    Index-TTS API接口 适配官方程序 简单说明【TTS | AI】
  13. 7:36
    视频去水印、去物体 ProPainter win整合包 【AI | 图像 | 视频 | 自媒体】
  14. 4:52
    云平台部署 ASR集合(FunASR、FireRedASR、PaddleSpeech、SenseVoice一网打尽,提供api接口或webui页面完成ASR工作
  15. 20:09
    洛曦Agent 功能讲解。支持MCP接入,自定义工具能力,默认提供文件操作、OCR、截图、文字找坐标、以图找坐标等,可以实现简单的自动化操作
  16. 2:52
    Real-ESRGAN 图片、视频超分 整合包 【图片清晰化 | 图片放大 | 视频超分】
  17. 3:21
    一键云部署 混元世界模型,文本、图片生成3D模型【开源 | 云平台 | AI | 3D | 腾讯 | 镜像】
  18. 4:47
    Squirrel-RIFE 视频补帧 整合包,WebUI跨设备访问【AI | 视频 | 补帧 | 免费 | python】
  19. 3:12
    FLAVR 视频补帧 2/4/8倍帧插值 整合包 【免费 | AI | python】
  20. 10:25
    AnchorCrafter 带货数字人视频生成,通过人-物交互视频生成技术,动画化展示您的产品
  21. 11:16
    HuMo 文本+图像 生成视频,云镜像一键部署。基于协作多模态条件的人体中心视频生成【AI | 视频 | 数字人】
  22. 21:01
    SAM2 图像和视频中的任何内容分割,云一键部署,为AnchorCrafter提供素材【含流视频转换、深度视频转换器】
  23. 1:25
    【开源】RAGFlow-OCR 毫秒级识别 CPU、GPU速度都很快,含整合包
  24. 2:28
    Edge-TTS-API 整合包,本地免费使用,带前端带密钥
  25. 0:48
    生成你的专属圣诞树🎄
  26. 2:00
    【开源】whisper-asr-webservice 本地ASR服务API win整合包
  27. 8:32
    【开源】AI全自动视频剪辑 ASR+LLM 智能提取分割输出精彩片段【win整合包】
  28. 9:23
    【开源】AI视频剪辑 理解Agent项目-FireRed-OpenStoryline 整合包
  29. 0:35
    OpenClaw Skills 你的电脑还能这样玩?AI神器让你秒变效率大神!【开源 | 免费】
  30. 8:32
    【开源项目】提示词自优化 如果你觉得提示词写不好 可能能够帮到你(
Description
仓库地址:https://github.com/Ikaros-521/RAGFlow-OCR

整合包下载( 其他开源项目 -> OCR -> RAGFlow-OCR )
夸克网盘:https://pan.quark.cn/s/936dcae8aba0#/list/share/219ecb0c9fa048da93f37df259af49af
百度网盘:https://pan.baidu.com/s/1CQm2Uky-qsIa4x1S9gvbjQ?pwd=6666&_at_=1759213115489#list/path=%2FAI-Vtuber%2F%E5%85%B6%E4%BB%96%E5%BC%80%E6%BA%90%E9%A1%B9%E7%9B%AE%2FOCR%2FRAGFlow_OCR&parentPath=%2F

视频使用CosyVoice2-0.5B克隆配音
没有演示CPU,实际效率和GPU差不多

Comments

過去の回忆 2025-10-15

不明觉厉[doge]

♥ 1

81PURE 2025-09-30

🐮

♥ 1 ↩ 1

艾歌的小熊太 2025-09-30

牛的

♥ 1 ↩ 1

bili_52388432599 2026-01-01

您好,这个可以处理pdf和tif格式的图片吗

↩ 1

挥霍的青春 2025-11-18

请问同样定位的a卡是不是特别慢

↩ 1

我的王之力啊123 2025-11-04

可惜不会用,小白想批量识别文字...但是不知道如何使用ai整了半天,还是没可以用的要是有可以批量识别图片为txt的bat或者py文件就好了,但还是投币了,谢谢大佬

↩ 3

zhouyenan 2025-10-22

没有显卡能用不?

↩ 1

myhloli 2025-10-11

这个就是ppocrv4的mobile版本[doge]

↩ 1

Jenery68 2025-10-02

牛逼!也可以拆一下bisheng的,不过真的要用还是不够的。

↩ 2

账号已注销 2025-10-01

有点意思,自己写的么?

↩ 1

AI视频总结 2025-09-30

AI课代表总结:视频完整演示了RAGFlow-OCR开源工具的核心功能与性能优势。系统采用轻量级设计,在RTX 4090显卡下单线程处理占用显存仅0.4GB,平均识别耗时0.862秒;支持模糊/倾斜文字精准识别(虽存在极少数边缘案例误判)。实测证实该工具具备高并发潜力(可支撑数十路并发),且提供配套整合包与GitHub仓库直达链接,便于开发者快速部署使用。 ✨ 咻!这OCR快到本喵瞳孔地震啦~⚡️