Description
以小博大,GLM-4.1V-9B-Thinking凭借 9B 的模型尺寸,成功占领 Hugging Face Trending第一🎉
GLM-4.1V-Thinking是一款支持图像、视频、文档等多模态输入的通用推理型大模型,专为复杂认知任务设计。它在GLM-4V架构基础上引入“思维链推理机制(Chain-of-Thought Reasoning)”,采用“课程采样强化学习策略(RLCS, Reinforcement Learning with Curriculum Sampling)”,系统性提升模型跨模态因果推理能力与稳定性。
其轻量版GLM-4.1V-9B-Thinking模型参数控制在10B级别,在兼顾部署效率的同时实现性能突破。该模型在MMStar、MMMU-Pro、ChartQAPro、OSWorld等28项权威评测中,有23项达成10B级模型的最佳成绩,其中18项更是持平或超越参数量高达72B的Qwen-2.5-VL,充分展现了小体积模型的极限性能潜力。GLM-4.1V-9B-Thinking标志着GLM系列视觉模型实现从感知走向认知的关键跃迁。
【开源地址】Github:https://github.com/THUDM/GLM-4.1V-Thinking
Hugging Face:https://huggingface.co/THUDM/GLM-4.1V-9B-Thinking
Comments
欢迎体验~ BV12q34zwEZS
♥ 6
ollama supporting will make it more popular.
♥ 5
确实不错,我写了 2 篇[呲牙]https://mp.weixin.qq.com/s/9WleuGBm3e8oL_XxgUGyjA
♥ 5
ollama没更新……
♥ 3
自打glm闭源,之后我就再也不用了。
♥ 1
做个3d吧,或者类似ollama这种,目前国内没人做的,而且竞争对手还少。
♥ 1
:-(?
图片文字识别还是弱,还得强化下。理解图片是没什么问题
能不能连入Claudecode里使用?
9b做成这样蛮不错的
我刚下的Qwen-2.5,岂不白瞎了[doge][doge][doge]
[呲牙][呲牙][呲牙]
牛逼的啊,狠狠学习了
加油
进攻
slide是用mcp做的吧[doge]