全新GLM-4v-plus,更强的视频理解能力

合集 · 多模态模型 (7)

  1. 46:40
    CogVLM2:第二代视觉大模型,19B即可比肩 GPT-4V
  2. 1:31
    全新GLM-4v-plus,更强的视频理解能力
  3. 3:24
    AI 的「phone use」时刻也来了
  4. 2:33
    GLM-4-Voice:国内首个端到端语音模型
  5. 2:04:49
    从 Sora 看多模态大模型的未来
  6. 1:35
    发布即开源!多模态大模型正在从“看得见”走向“看得懂、想得通”。
  7. 1:25:15
    开源通用视觉语言模型GLM-4.1V-Thinking技术分享

Comments

-幽穆- 2024-10-25

视频理解纸面数据薄纱gemini1.5pro,实际用起来比人家少个音频这个模态,没字幕就只能搁那干瞪眼

♥ 7

湉栎 2024-10-25

智谱清言app是不是没有提供这个模型?

♥ 4 ↩ 3

躺平生活 2024-11-19

GLm4 plus还是文心4.0强 主要用于看书的时候帮我解答看不懂的地方

♥ 1

希卡利亮 2024-10-25

你好,该模型用于为图片做标注可以吗?能力对比qw2-vl,llama3.2,minicpm-v2.6之类如何

♥ 1

LLMLearner 2024-10-25

来体验:https://open.bigmodel.cn/?utm_campaign=open&_channel_track_key=OWTVNma9

♥ 1

AI总结视频 2024-10-25

课代表总结:视频展示了多个视频理解模型的比较,包括LLaVA-NeXT-Video、PLLaVA、GPT-4o、Gemini 1.5Pro和GLM-4V-Plus等。GLM-4V-Plus在视频理解和多轮对话任务中表现出色。视频还展示了几个篮球比赛的场景,包括球员运球、投篮和得分等动作,并配有中文和英文的字幕。GLM-4V-Plus在处理视频时的效率和成本分析显示,每分钟可以处理6条视频,每条视频只需20元。视频最后鼓励观众访问BigModel平台以探索视频理解大模型。 ✨ 本喵看完这个视频,觉得GLM-4V-Plus在视频理解和多轮对话任务中都表现出色,处理视频的效率和成本也非常高效。这个模型简直是AI领域的新杰出人物! --内容由@AI视频总结 生成,仅供参考【很棒的视频,快给up主点赞】

♥ 1

怀零柒肆伍0745 2024-10-25

nice

yiyan32 2024-10-25

感谢!