【官方教程】ChatGLM3-6B 部署和微调(Function Call、Code Interpreter、Agent)

合集 · 模型部署和微调 (9)

  1. 42:53
    「官方教程」GLM-4-9B 实战部署和微调
  2. 1:08:52
    探索GLM-4-9B开源模型:ITREX — LLM工具实战
  3. 2:01
    ChatGLM3 一键安装,懒人专属
  4. 33:26
    低配置部署 ChatGLM3-6B | 智谱 × 魔搭社区
  5. 57:09
    【官方教程】ChatGLM3-6B 部署和微调(Function Call、Code Interpreter、Agent)
  6. 1:07:45
    【官方教程】ChatGLM 的 Prompt 工程实践,真实案例详解
  7. 1:03:23
    【官方教程】ChatGLM2-6B 部署与微调
  8. 1:10:13
    【官方教程】ChatGLM + LangChain 实践培训
  9. 1:18:45
    【官方教程】ChatGLM-6B 微调:P-Tuning,LoRA,Full parameter
Description
ChatGLM3 技术文档:https://zhipu-ai.feishu.cn/wiki/YInmwPmyii67VRkzU3BchPNzncg

模型仓库:https://github.com/THUDM/ChatGLM3

模型下载:
HF:https://huggingface.co/THUDM
魔搭:https://modelscope.cn/models/ZhipuAI

文件下载:https://pan.baidu.com/s/14NtD9A3Ls3VkuIPy8Iar8Q?pwd=na5c 提取码: na5c

Comments

figo3dg6 2023-11-07

[喜极而泣]今天用CPU跑来起了,内存不够硬盘凑,问个你好,硬盘疯狂读写二十分钟后,终于回复了。

♥ 59 ↩ 9

酒吃三口 2023-11-02

6b规模做成这样已经很棒了,网传gpt-3.5是20b[脱单doge]

♥ 56 ↩ 6

Kdump 2023-11-01

请问微调代码什么时候上传到github?谢谢

♥ 56 ↩ 12

芹之见 2023-11-02

作者你好,请问有量化版本吗,绝大多数人的显卡显存在12GB以下[脱单doge]

♥ 49 ↩ 25

Dubai终于有硬币改名了 2023-11-01

视频简介: 模型仓库: 链接见视频简介 模型下载: HF: 链接见视频简介 魔搭: 链接见视频简介 文件下载: 链接见视频简介 提取码: na5c

♥ 40 ↩ 1

语核 2023-11-03

相当出色的模型[支持][支持]三连了! 顺带一问,chatglm3支持了function call,不知道up是否了解 如果想给glm3微调入一些固定的function call,需要用什么微调数据集格式和方法[脱单doge]

♥ 22 ↩ 3

超能勇士初号机 2023-11-01

想问下跑ChatGLM3推荐的硬件配置是什么?

♥ 22 ↩ 21

头疼的小吴 2023-11-01

3都出来了?逻辑能力能提高多少?[星星眼] 最重要的是能不能变猫娘[doge]

♥ 17 ↩ 15

Freiheit-LOL 2023-11-09

效果惊人的好 可以int4 int8 不量化在gpu或者cpu上跑。就是量化以后智商直线下降,所以我现在直接cpu跑了,gpu用了共享的内存速度跟cpu一样慢,那就干脆腾出空位运行其他的东西好了[脱单doge]

♥ 14 ↩ 6

洪溪摄国际 2023-11-01

这个模型当之无愧中国第一!支持直接上传文本训练就好啦。

♥ 14

小明同学开发日记 2023-11-03

国内唯一看好的模型[doge]

♥ 12

有趣的程序员 2023-11-02

【内容总结】 本视频是关于ChatGLM3-6B模型的部署和微调的官方教程。视频介绍了ChatGLM3-6B模型的基本特点和性能,以及模型的应用开发示例。视频演示了模型的基本对话能力、工具调用功能和代码解释器功能,并展示了模型在不同场景下的应用效果。视频还详细介绍了模型的对话格式和微调方法,以及使用Function Call、Code Interpreter和Agent等工具进行模型的部署和微调的步骤。观众评论中提到了对微调代码的期待和模型的性能等问题。 【时间线】 - 00:00 - 视频介绍了ChatGLM3-6B模型的基本特点和性能。 - 01:34 - 演示了模型的基本对话能力,包括遵循指令和表情回答。 - 04:05 - 演示了模型的工具调用功能,如查询天气和绘制图案。 - 06:03 - 演示了模型的代码解释器功能,包括计算和几何问题的求解。 - 08:28 - 演示了模型的多轮对话能力,包括生成随机数、排序和求平均数等操作。 - 12:59 - 介绍了ChatGLM3-6B模型的对话格式和微调方法,包括特殊token和metadata的使用。 - 13:46 - 详细讲解了模型的对话格式和工具调用的实现方式。 - 20:12 - 介绍了模型通过token来表示工具调用的方法。 - 23:30 - 解释了推理系统如何解析模型的工具调用参数。 - 24:03 - 视频介绍了Function Call和Code Interpreter的使用方法,以及它们在模型部署中的作用。 - 26:31 - 介绍了Code Interpreter的使用,包括system prompt和assistant interpreter的概念。 - 29:46 - 讨论了为什么使用Python作为工具调用的语言,以及Python的表达能力和拓展性。 - 31:56 - 介绍了Coding Prompt的使用方法和注意事项,以及如何将对话转化为模型可接受的格式。 - 36:14 - 讲解 内容由AI自动总结, 总结内容仅供参考~ @华程朱 触发了视频总结, 触发方式是 @有趣的程序员 总结一下

♥ 12

小猪保护主义 2023-11-02

hugging face也上不去了… 反诈提示… 逼我clash…

♥ 12 ↩ 12

FeiVw不是废物 2023-11-02

毕设的迁移学习对象有着落了,gpt2可以滚了[doge]

♥ 11

Ba0ob 2023-11-02

啊这,这都发3了。好哥哥救救救 前两天自己写了个adapter微调chatglm2,在前向传播过程中出现 nan /inf ,我自己测了异常值出现在 chatglm 模块。该现象不论是 fp16 还是 fp32 都会产生。[藏狐]

♥ 11 ↩ 5

懂的都懂你细细品 2023-11-01

这些功能感觉都不是很惊喜

♥ 7 ↩ 8

植仁2020 2023-11-11

AI的应用在某方面是一种阴谋,就是让更多天真的人相信只要有AI就可以享受人生了。这道理就好像彩票行业一样,很多人深信只要花几元钱就有机会赚几个亿的奖金,但是有几个人能赚到彩票的奖金呢?AI最终是让优秀的人更加优秀,而贫穷的人更加贫穷,从而让社会更好的风华,让天真的人放弃学习和努力的权利。历朝历代都会出现这种情况,农民 初期都是有土地的,但是后来受不了诱惑就把自己的土地转卖了,然后几年不到就被市场的规律给洗劫一空,最后只能沦为别人的生产工具。

♥ 5 ↩ 1

账号已注销 2023-11-09

加油啊UP主,太喜欢你的模型了

♥ 5

腹黑の晓天 2023-12-11

这两天测试了一下, 也把官方提供的几个demo研究了一下, 总体来说确实比glm2好许多, 也比之前用过的baichuan, yi 6b好. 但作为生产工具还是差了太多. 不知道什么时候蒸馏过的小模型也能达到100b参数模型的效果.

♥ 4

吃个小鱼丸叭 2023-11-03

想问一下用代码调用大模型生成回答为什么特别慢,回复的很慢,4060显卡

♥ 4 ↩ 7