【Qwen2-VL】一键包 千问2视觉语言大模型开源 2B、7B以及72B

Description
https://www.123pan.com/s/Pf5Yjv-YiAW3
提取码一键三连+关注可见(x
什么?关注了也没有?那你看完简介再说
====================
3个依赖是dev版本,cuda12.4
有报错的话,截图发评论区
====================
恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~

Comments

Lain_汐泠 2024-09-17

up您好,我最近在研究Ollama+webui的部署方案。不过这个Qwen2-VL是.safetensors格式的模型,Ollama那边只能导入.gguf格式的,所以需要用llama.cpp转换模型格式,但是我最近按网上给的流程试了试,转换不了,是llama.cpp那边还没有适配还是为什么?有没有这类转换模型的教程呀[黑眼圈_金箍]

♥ 2 ↩ 4

我是cloud 2024-08-31

如何使用cpu和内存跑呢?显存不够用

♥ 2 ↩ 1

jojoyour 2024-08-30

请问如何实现描述视频功能,试过拖入视频然后让其描述视频内容,但是失败了后台提示“ImportError: PyAV is not installed, and is necessary for the video operations in torchvision”,然而命令行执行pip install av安装PyAV后,还是失败并如上提示

♥ 2 ↩ 4

Lain_汐泠 2024-09-17

一键包好评,给大佬点赞

♥ 1

arrow虎 2024-09-18

抱脸上可以创建Q4等GGUF模型,我试了一下,总是报错 gguf-my-repo https://huggingface.co/spaces/ggml-org/gguf-my-repo Hub Model ID: Qwen/Qwen2-VL-7B-Instruct-GPTQ-Int4 Hub Model ID: nvidia/NV-Embed-v2 UP主愿意试试这两个模型Q4_K_M量化吗?,qwen2-VL只有F16,NV-Embed-v2是最新最强检索增强模型,目前也没找到GGUF模型

♥ 1

不动不语 2024-09-03

无私分享不需要扫描微信或私信的都要给投币点赞。

♥ 1

Berserker3912 2024-08-30

torch torchvision torchaudio cuda分别是什么版本呢 您是什么显卡

♥ 1 ↩ 1

Berserker3912 2024-08-30

没这个 Qwen2VLForConditionalGeneration 大佬怎么解决的

♥ 1 ↩ 2

c刺桐花l 2024-12-21

一键三连咯

Cooper918 2024-12-12

请问换2B模型是下载.safetensors格式的模型吗?如果是的话,模型自行下载好之后放在哪个路径下哟?谢谢啦!

↩ 1

泽金生 2024-11-26

能否使用 API?

↩ 1

成果and诸葛大力 2024-11-06

大佬我是8卡机,运行VL-72B的总是报这个错误,我用你的启动包和官网的代码去运行都报这个错误!!!

↩ 1

BK6180D3 2024-10-27

这是什么问题?文字对话正常使用,图片识别就报错

↩ 1

老王和隔壁的小舅子 2024-10-12

这网盘下载还要付钱啊,我宁愿把钱给UP

↩ 1

flash飞絮 2024-09-29

一键三连

不动不语 2024-09-24

感谢分享,能顺利运行,可惜我的显存太小,玩不转VL

↩ 2

0光轮0 2024-09-23

好像是只能识别图片?我这pdf文件不是很大,3.5m

↩ 1

0光轮0 2024-09-22

大佬,怎样让它识别pdf文件啊,我传了pdf上去报错了,是UI不识别吗

↩ 2

魔法少女琉璃苣 2024-09-10

占用好高哩,我70tisuper16G显存被狠狠灌注成了Qwen2VL的形状,而且推理速度还挺慢的。[doge_金箍]

↩ 1

魔法少女琉璃苣 2024-09-10

这两个包下下来跟视频里也不一样啊

↩ 2