4小时打造垂域专属大模型,Qwen3企业级微调实战!详解数据集创建方法+微调流程+微调模型性能评估完整流程|实现知识灌注、MCP能力增强、推理性能优化!
Parts
Description
4小时从零打造垂域专属大模型,Qwen3企业级微调实战教程来啦!详解数据集创建方法+微调流程+微调模型性能评估全流程,完整实现知识灌注、MCP能力增强、推理性能优化,快速打造高质量垂域专属大模型! ✅置顶评论扫码加入【赋范大模型技术社区】,领【本课程完整课件】,以及更多【大模型Agent智能体开发硬核技术干货】内容+无门槛技术交流,期待你的加入!
Comments
b站上zui清晰的微调课程没有之一 居然还是免费的!
♥ 77 ↩ 1
技术更新太快了!能出一个qwen3deep research的手搓嘛[喜欢][喜欢][喜欢]
♥ 18 ↩ 2
想请教一下老师,特定领域专业数据(不是现成可下载的,需要自己拼装,只有问答那种的),如何构建带有思维链的微调数据集?
♥ 9 ↩ 6
不是哥们,你真教啊,那我可要三联了
♥ 8 ↩ 6
ollama下运行qwen3的4bit量化版非常容易陷入死循环,运行8bit正常,不知道是不是ollama的问题
♥ 8 ↩ 9
老师您好,有一个问题请教,我用Windows部署的llama factory微调的qwen2.5vl: 7B模型,微调完成后在llama factory页面运行没有问题,然后把模型部署到Linux服务器上(有四张显卡),用ollama部署的,能加载模型信息,但是模型跑起来的时候就卡了,完全用不了。这是兼容性问题吗,只要没有看到说兼容性问题的文档,不知道问题在哪了?
♥ 5 ↩ 1
有大佬跟着做出来了吗?为什么我最后保存微调后的模型显示RuntimeError: Bad in-place call:input tensor size 【65536000, 1】 and output tensor size 【5120, 25600】 should match
♥ 5 ↩ 1
目前看到第七集,被数据集震撼到了,想不到世界上真的有人会免费公开几百万条精选数据构成的数据集,计算机的起源就是开源精神[大哭]
♥ 4
感觉qwen3的幻觉比qwen2.5还重
♥ 4
听的最明白的一次,谢谢老师
♥ 4
九天老师,我跟着您的教程按照您的参数和数据集微调了Qwen3-14b,但是看到loss曲线在四十多步后就不再下降了。我觉得很奇怪。于是我把您的"Qwen3高效微调(下).ipynb"文档中大规模微调部分的loss作了图,结果也没有下降,而是一直在震荡。请问九天老师和万能的网友,这样难道是正常的吗?[思考] @九天Hector
♥ 3 ↩ 4
突然意识到我在微调自己[哦呼]
♥ 3
请问老师、各位大哥,我在按照课件中的命令行(pip install --upgrade --force-reinstall --no-cache-dir unsloth unsloth_zoo)安装unsloth后,出现报错 “Failed to build xformers ERROR: Failed to build installable wheels for some pyproject.toml based projects (xformers)”,请问有大佬可以指点我下该如何解决吗?
♥ 3 ↩ 3
已三连,礼貌求课件
♥ 3 ↩ 1
不愧是九天老师,厉害!
♥ 3
不推荐,啰里啰嗦,广告太多。成功躲避所有重点,一到重点就广告,毫无诚心。
♥ 2
我发布了一篇笔记,快来看看吧~
♥ 2
我以为是从一个业务去制作一个数据集
♥ 2