【Qwen2-VL】一键包 千问2视觉语言大模型开源 2B、7B以及72B
Description
https://www.123pan.com/s/Pf5Yjv-YiAW3 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 3个依赖是dev版本,cuda12.4 有报错的话,截图发评论区 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
https://www.123pan.com/s/Pf5Yjv-YiAW3 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 3个依赖是dev版本,cuda12.4 有报错的话,截图发评论区 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
Comments
up您好,我最近在研究Ollama+webui的部署方案。不过这个Qwen2-VL是.safetensors格式的模型,Ollama那边只能导入.gguf格式的,所以需要用llama.cpp转换模型格式,但是我最近按网上给的流程试了试,转换不了,是llama.cpp那边还没有适配还是为什么?有没有这类转换模型的教程呀[黑眼圈_金箍]
♥ 2 ↩ 4
如何使用cpu和内存跑呢?显存不够用
♥ 2 ↩ 1
请问如何实现描述视频功能,试过拖入视频然后让其描述视频内容,但是失败了后台提示“ImportError: PyAV is not installed, and is necessary for the video operations in torchvision”,然而命令行执行pip install av安装PyAV后,还是失败并如上提示
♥ 2 ↩ 4
一键包好评,给大佬点赞
♥ 1
抱脸上可以创建Q4等GGUF模型,我试了一下,总是报错 gguf-my-repo https://huggingface.co/spaces/ggml-org/gguf-my-repo Hub Model ID: Qwen/Qwen2-VL-7B-Instruct-GPTQ-Int4 Hub Model ID: nvidia/NV-Embed-v2 UP主愿意试试这两个模型Q4_K_M量化吗?,qwen2-VL只有F16,NV-Embed-v2是最新最强检索增强模型,目前也没找到GGUF模型
♥ 1
无私分享不需要扫描微信或私信的都要给投币点赞。
♥ 1
torch torchvision torchaudio cuda分别是什么版本呢 您是什么显卡
♥ 1 ↩ 1
没这个 Qwen2VLForConditionalGeneration 大佬怎么解决的
♥ 1 ↩ 2
一键三连咯
请问换2B模型是下载.safetensors格式的模型吗?如果是的话,模型自行下载好之后放在哪个路径下哟?谢谢啦!
↩ 1
能否使用 API?
↩ 1
大佬我是8卡机,运行VL-72B的总是报这个错误,我用你的启动包和官网的代码去运行都报这个错误!!!
↩ 1
这是什么问题?文字对话正常使用,图片识别就报错
↩ 1
这网盘下载还要付钱啊,我宁愿把钱给UP
↩ 1
一键三连
感谢分享,能顺利运行,可惜我的显存太小,玩不转VL
↩ 2
好像是只能识别图片?我这pdf文件不是很大,3.5m
↩ 1
大佬,怎样让它识别pdf文件啊,我传了pdf上去报错了,是UI不识别吗
↩ 2
占用好高哩,我70tisuper16G显存被狠狠灌注成了Qwen2VL的形状,而且推理速度还挺慢的。[doge_金箍]
↩ 1
这两个包下下来跟视频里也不一样啊
↩ 2