不要浪费钱买课了,喂饭式教你训练大模型llama3

合集 · 有手就行 (12)

  1. 3:20
    万物皆可参考!AI参考生视频太好用了!
  2. 5:05
    我用AI当助教,一天学会游戏开发!
  3. 4:21
    看了这融合结果,我尬了... | 二次元角色融合工作流 | ComfyUI | Flux.1
  4. 5:46
    5分钟学会用AI修复老照片:高清、上色、动态 | 原理 | 实操 | ComfyUI | Flux.1
  5. 4:51
    领导: 代码跑还是你跑?
  6. 6:06
    5分钟学会在Windows上搭建模型训练环境 | WSL安装| CUDA | Conda | Unsloth
  7. 4:51
    如何让洋模型精通西游记 | 5分钟学会微调大模型Gemma2
  8. 7:26
    我用2天开发了一个AI背单词的小程序
  9. 7:18
    一步步教你用ComfyUI生成像素风视频
  10. 6:58
    4202年了,还有人以为训练大模型很难吗?| 3分钟学会微调大模型Qwen2
  11. 3:59
    也不是非得英伟达不可 | 3分钟速通苹果电脑大模型训练
  12. 7:54
    不要浪费钱买课了,喂饭式教你训练大模型llama3
Description
大家有什么疑都可以在评论区提问,我看到都会尽量回答~
发【 llama3】 自动回复下载整包,包含原始模式,微调过的模型和代码,训练集
训练环境:
WSL2 on Windows 11
Ubuntu 22.04
torch = 2.2.2
python=3.12
cuda 11.8

Comments

植食系YD 2024-05-13

谢谢分享流程[嗑瓜子]不过我记得之前看过跟踪新闻说的是那个教授回应弱智吧训练效果最好的原因是,那个教授拿弱智吧的问题去让chatgpt回答,然后用chatgpt的答案作为训练集训练效果好[嗑瓜子]而不是直接用弱智吧的emm回答作为训练集训练才会效果好[妙啊]

♥ 96 ↩ 7

here_s 2024-06-06

训练? 花钱! 我们现在就要准备折腾P40 24G垃圾王,我预感到这玩意和买数码相机一样的,越到后面显卡的性能越是不能满足你 到最后大家比的就是谁的钱开销最大....

♥ 89 ↩ 3

-雷切- 2024-05-18

训练的时候有报错误: RuntimeError: The local rank is larger than the number of available GPUs. 训练使用的是4090显卡,up 主有遇到这个问题吗? 把配置文件中的环境参数修改为:device: cuda:0,报错依旧。

♥ 69 ↩ 14

星月依恋 2024-07-04

出个胎教级流程吧,o门口跟两部内容就断点了,

♥ 15 ↩ 2

Morgen_L 2024-05-19

up主,请问一下我用llamafactory跑了70B的lora训练,按官方教程用unsloth插件,最后用llamafatory的chat功能测试的时候都没啥问题,但是一旦量化到int8或者int4,放到llamacpp里面运行也OK,但是一到ollama就死。。。。不知道是为啥,能给点儿思路么

♥ 15 ↩ 8

账号已注销 2024-05-12

进行Q4量化的时候报错了…

♥ 15 ↩ 3

最后の魅 2024-05-11

up,用一个人物的背景故事和对话做成一个数据集,来微调大模型,从而来打造一个ai人设吗?

♥ 9 ↩ 4

bili_37014281923 2024-08-12

花子大佬,我下载了你制作的中文llama3,8b模型了,如何调用啊,在openwebUI中,搜索不到模型呢

♥ 5 ↩ 12

夏季拔丸 2024-07-09

请问up我怎么在wsl2系统中下载您修改过的torchune? 我现在装好了wsl2系统并且在Windows当中下载了您的llama3相关的资料 我下一步应该怎么办呢?

♥ 5 ↩ 13

iamyoursli 2024-05-19

众所周知国内的高科技公司没有这些国外公司开源,早就倒闭了!

♥ 5

111已三连 2024-10-02

我一个初中没毕业的,虽然看不懂,但我还是认真的看完了[doge_金箍]

♥ 3 ↩ 1

Cyber_Artist 2024-05-11

全参量,qlora和lora体验起来差别大吗,据说量化代码能力下降会很严重

♥ 3 ↩ 2

耄耋归位 2024-10-21

@我是天才哇 可以看看这个up的投稿,我就是用他的方式订阅chatgpt的

♥ 2 ↩ 1

菠萝白菜仔 2024-05-17

你好哇,我想问一下,我用了ruozhiba的数据+林亦的B站评论数据,4060ti,训练的命令行loss后面显示478,我估摸要8个小时,速度正常吗,是不是跑完就会自动停止。

♥ 2 ↩ 2

青太白 2024-05-14

等我20多天后考完试再细细研究[doge]

♥ 2

白色魔瑰 2026-02-06

怎...怎么收集训练数据集?我是纯手打的,打完再放jsonl网页调整格式[大哭]好累

♥ 1

蝈蝈不存在 2025-07-23

我这个小学毕业的,看完了,居然看懂了一点点。 说明UP主讲解的非常到位。

♥ 1

尘XNS 2025-05-17

简直就是活菩萨呀,感谢up主分享🙏[大哭]

♥ 1

殇末雨曦 2025-01-25

在线请求出一下详细的使用llama.cpp量化的过程,就差转成gguf了,卡在转格式这里了

♥ 1 ↩ 1

梅西库里UZl 2024-11-13

我想问一下,这种上传数据集微调的模式,和一些公开使用的大模型平台里面的知识库调用是不是一样的效果?

♥ 1