【Qwen2.5-Omni】一键包更新 GPTQ-4bit量化 16G显存可用 阿里云开源全模态模型
合集 · Qwen2.5-Omni (2)
Description
下载链接见评论置顶 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 请确认安装MSVC 有报错的话,截图发评论区 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
下载链接见评论置顶 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 请确认安装MSVC 有报错的话,截图发评论区 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
Comments
你这效率是真高呀
♥ 1
牛掰glass
♥ 1
高产似那个[捂眼][捂眼][捂眼]
♥ 1 ↩ 1
5090显卡可以用吗
↩ 1
如果显存有32个G,是不是可以直接部署Qwen2.5-Omni-7B非量化版本更好点?
↩ 1
多卡行吗?
↩ 1
为什么回答第一个问题很快,接着问第二个问题回答就遥遥无期了?
↩ 1
vllm支持多模态么?
↩ 1
报错找不到cuda,确认已安装cuda12.4.1,设置了环境变量CUDA_PATH和CUDA_HOME
↩ 1
50系显卡无法运行
↩ 4
4080能用吗 32个内存
能不能搞个实时的呀?就是跟官方的演示页面一样的效果。
↩ 1
File "<frozen importlib._bootstrap>", line 571, in module_from_spec File "<frozen importlib._bootstrap_external>", line 1176, in create_module File "<frozen importlib._bootstrap>", line 241, in _call_with_frames_removed torch._dynamo.exc.BackendCompilerFailed: backend='inductor' raised: ImportError: DLL load failed while importing cuda_utils: 找不到指定的模块。Set TORCH_LOGS="+dynamo" and TORCHDYNAMO_VERBOSE=1 for more informationYou can suppress this exception and fall back to eager by setting: import torch._dynamo torch._dynamo.config.suppress_errors = True 请问up主这是什么情况
↩ 1
老大,你太帅了。爱你🥰
运行不了,FlashAttention的问题,说不支持,我是2080ti
↩ 1
请问amd显卡可以用吗
↩ 3
这是为什么
↩ 1
没有文字对话输入窗口?
↩ 1
You are attempting to use Flash Attention 2.0 without specifying a torch dtype. This might lead to unexpected behaviour
↩ 1