【开源】AnchorCrafter 带货数字人视频生成,通过人-物交互视频生成技术,动画化展示您的产品

合集 · 开源/免费项目 (30)

  1. 14:11
    Ultralight-Digital-Human 一个超轻量级、可以在移动端实时运行的数字人模型,赠整合包【开源项目】
  2. 8:19
    F5-TTS 一句话克隆声音,开源TTS,附赠Windows整合包,有兴趣的可以玩玩0.0
  3. 6:28
    Mini-Omni 一个开源的多模态大型语言模型,可以边听边说边思考。具有实时端到端语音输入和流式音频输出会话功能。
  4. 10:05
    【免费TTS】MultiTTS 安卓APP(Win电脑部署),可以提供API接口、用于听书等服务,提供在线搜集的语音包
  5. 23:38
    GraphRAG-Ollama-UI + GraphRAG4OpenWebUI 融合版,WebUI + API,提供win整合包,值得一玩喵【开源项目】
  6. 12:38
    FunAudioLLM-APP win整合包,ASR+LLM+TTS(sensevoice+dashscope+CosyVoice)【开源项目】
  7. 26:51
    Auto-GPT 手把手带你一起部署体验,我也是第一次用哈,懂的都懂
  8. 19:13
    MeloTTS 高质量多语言文本转语音,支持训练,提供API, 赠win整合包,类似bert vits2
  9. 7:11
    F5-TTS API服务,提供密钥鉴权能力,UUID参考音频文本管理,兼容AUTODL,为你的后端调用提供赋能,FastAPI+Swagger文档,轻松上手
  10. 7:43
    FunASR WS Win整合包,实时ASR,对接AI Vtuber和LiveTalking【语音识别 | 语音转文本 | 阿里 | 免费 |白嫖】
  11. 5:56
    LLama-Factory lora模型 调用API,OpenAI接口协议,为你的模型微调应用赋能 【LLM | Qwen | 模型微调 | 训练 | API】
  12. 2:49
    Index-TTS API接口 适配官方程序 简单说明【TTS | AI】
  13. 7:36
    视频去水印、去物体 ProPainter win整合包 【AI | 图像 | 视频 | 自媒体】
  14. 4:52
    云平台部署 ASR集合(FunASR、FireRedASR、PaddleSpeech、SenseVoice一网打尽,提供api接口或webui页面完成ASR工作
  15. 20:09
    洛曦Agent 功能讲解。支持MCP接入,自定义工具能力,默认提供文件操作、OCR、截图、文字找坐标、以图找坐标等,可以实现简单的自动化操作
  16. 2:52
    Real-ESRGAN 图片、视频超分 整合包 【图片清晰化 | 图片放大 | 视频超分】
  17. 3:21
    一键云部署 混元世界模型,文本、图片生成3D模型【开源 | 云平台 | AI | 3D | 腾讯 | 镜像】
  18. 4:47
    Squirrel-RIFE 视频补帧 整合包,WebUI跨设备访问【AI | 视频 | 补帧 | 免费 | python】
  19. 3:12
    FLAVR 视频补帧 2/4/8倍帧插值 整合包 【免费 | AI | python】
  20. 10:25
    AnchorCrafter 带货数字人视频生成,通过人-物交互视频生成技术,动画化展示您的产品
  21. 11:16
    HuMo 文本+图像 生成视频,云镜像一键部署。基于协作多模态条件的人体中心视频生成【AI | 视频 | 数字人】
  22. 21:01
    SAM2 图像和视频中的任何内容分割,云一键部署,为AnchorCrafter提供素材【含流视频转换、深度视频转换器】
  23. 1:25
    【开源】RAGFlow-OCR 毫秒级识别 CPU、GPU速度都很快,含整合包
  24. 2:28
    Edge-TTS-API 整合包,本地免费使用,带前端带密钥
  25. 0:48
    生成你的专属圣诞树🎄
  26. 2:00
    【开源】whisper-asr-webservice 本地ASR服务API win整合包
  27. 8:32
    【开源】AI全自动视频剪辑 ASR+LLM 智能提取分割输出精彩片段【win整合包】
  28. 9:23
    【开源】AI视频剪辑 理解Agent项目-FireRed-OpenStoryline 整合包
  29. 0:35
    OpenClaw Skills 你的电脑还能这样玩?AI神器让你秒变效率大神!【开源 | 免费】
  30. 8:32
    【开源项目】提示词自优化 如果你觉得提示词写不好 可能能够帮到你(

Parts

  1. P1 · 202509122048
  2. P2 · 合成效果0-采样步长1-引导尺度4-11帧-15fps
  3. P3 · 合成效果1-采样步长2-引导尺度4-11帧-15fps
  4. P4 · 合成效果2-引导尺度3-60帧-15fps
  5. P5 · 合成效果3-引导尺度3-60帧-15fps
  6. P6 · 合成效果4-引导尺度3-90帧-30fps
  7. P7 · 官方展示视频-1
Description
项目地址:https://github.com/cangcz/AnchorCrafter
fork地址:https://github.com/Ikaros-521/AnchorCrafter
优云GPU服务镜像:https://www.compshare.cn/images/w2ArgcG3iSN5?referral_code=CpxneZgXby6EOmUwLGr7hQ

SAM2云镜像(扣手、扣物体):https://www.compshare.cn/images/W7N7qMigIOe7?referral_code=CpxneZgXby6EOmUwLGr7hQ

注意点:
1. 测试发现,分辨率超576会爆显存或报CUDA核心错误。
2. 目标物体需要是目标视频内的切图,替换成其他目标物图片会导致最终视频中的物体错乱模糊

Comments

不蠢不蠢 2025-09-13

同类型最新算法是字节的humo

♥ 1 ↩ 2

cangcz 2025-09-22

是二次元大佬!

↩ 1

Love丶伊卡洛斯 2025-09-16

另外 不使用深度视频合成也正常,可以少一步处理

Love丶伊卡洛斯 2025-09-16

num_frames: 11 # 分块处理的帧数 resolution: 576 # 控制最终输出视频的分辨率 frames_overlap: 5 # 帧重叠数,用于保证帧间连续性 num_inference_steps: 30 # 推理步数 noise_aug_strength: 0 # 噪声强度 guidance_scale: 4.0 # 引导尺度 sample_stride: 2 # 采样步长,从输入视频中每隔x帧取1帧 fps: 15 # 控制最终输出视频的播放帧率 seed: 42 # 随机种子

Love丶伊卡洛斯 2025-09-16

测试合成的视频参数有误导致效果较差,新效果参考2P!!!

私有知识库智售机器人 2025-09-13

AI卖货价值高,数字人视频生动展示产品,提升吸引力;优势在于自动化、低成本、互动性强,有效促进销售转化。【短视频生成、ai评论自动化】

莫得白渡 2025-09-13

https://b23.tv/BV1hubzzDEcv 深度图用这个能行吗[笑哭]

↩ 3

AI工具集 2025-09-12

AI课代表总结: 视频强势揭秘开源神器AnchorCrafter的革命性力量,让每个人都能变身智能数字导购!只需上传一张真人照片和简单动作录像,系统瞬间生成超逼真的产品互动视频,彻底打破传统电商图文堆砌的沉闷局面,让商品自带灵魂开口吆喝。 要点: 目标人物照片一秒完成高精度身份复刻|动作视频注入灵动肢体语言赋予生命力|深度图技术完美剥离商品并勾勒手部轨迹|云端一键部署免运维门槛快捷高效|首版生成视频虽略显细腻不足但创新性直击行业痛点|商业化落地潜力巨大引发强烈兴趣热潮

艾歌的小熊太 2025-09-12

牛哇

↩ 1