原生多模态!匿名模型 Ox Alpha 今日揭晓:GLM-5.3-Flash,定价仅十分之一

合集 · 新闻简讯 (4)

  1. 2:15
    GLM-5.3 发布:超越 Kimi K3,开源编程第一
  2. 3:44
    DeepSeek V4 API 最新价格:涨价时间确定
  3. 2:35
    原生多模态!匿名模型 Ox Alpha 今日揭晓:GLM-5.3-Flash,320B 开源
  4. 8:20
    万张截图不到一美元?8 分钟看完 DeepSeek 视觉模型
Description
上周 OpenRouter 上最火的匿名模型 Ox Alpha,今天揭晓正身:智谱 GLM-5.3-Flash,320B 原生多模态,MIT 权重已放出。一支视频看完全部数据。

看点:
1. 它上周以匿名身份空降 OpenRouter,免费、1M 上下文、能看图看视频,一周冲上双平台调用量第一——社区用 tokenizer 指纹和错误码 1210 把它认了出来
2. Artificial Analysis 拿了 57 分,和 Claude Opus 4.8 持平,但每个任务只要 $0.045;六项基准全胜上代,DeepSWE 和 AutomationBench 直接超过 Opus
3. 最狠的一件事:那一周的匿名流量,全部跑在国产芯片上,官方称端到端性能提升了 3 倍

关键内容:
· 解谜线:08-20 匿名上线 · tokenizer 计数与 GLM-5.3 完全一致 + 恒定 75 token 偏移 · 关 thinking 报错 1210 逐字一致 · 上一个匿名模型 Pony Alpha 就是 GLM-5
· 揭晓:GLM-5.3-Flash · GLM-5 系列首个原生多模态 · 320B 总参 / 18B 激活 · 1M 上下文 · 文本参数与 GLM-5.3 一致
· 跑分:AA 指数 57 分 @ $0.045/任务,站上价格-智力前沿;六项基准全胜 GLM-5.2(TB2.1 84.3 · DeepSWE 63.4 · AutomationBench 48.8 · GDPVal 1773)
· 诚实对照:DeepSWE 与 AutomationBench 超 Opus 4.8;TB2.1、HLE、ALE 三项仍落后,官方口径是综合逼近
· 架构:稀疏 × 线性混合注意力(开源首个)· 注意力计算 ↓3.01× · KV 缓存 ↓4.44× · 官方自认 KV 缓存仍大于 Kimi-K3 / DS-V4-Flash
· 价格:$0.11/$2.2 每百万 token · 官方口径为 GLM-5.3 的 1/10、限时折扣 1/20、Opus 4.8 的 1/40 · Coding Plan 额度 3×
· 国产芯片:数万颗加速器 · EPD 分离架构 · 端到端性能 3× · 硬件效率与单 token 成本约为主流英伟达 GPU 水平(官方口径)
· 多模态:视觉原生进 coding 循环 · Blender 自主运行 16 小时搭出约 400㎡ 主厨住宅与测试厨房
· 上线:MIT 开源权重已放出(仓库比官宣早一天建)· API / ZCode / Coding Plan 同步开放
· 迁移警示:thinking 仅支持 enabled,从 disabled 迁移要改成 enabled + reasoning_effort:"low",否则请求失败

来源:
· 官方博客:z.ai/blog/glm-5.3-flash
· 模型文档:docs.z.ai / docs.bigmodel.cn(GLM-5.3-Flash 页)
· 权重仓库:huggingface.co/zai-org/GLM-5.3-Flash
· 社区取证:OpenRouter 页面存档与 Reddit 指纹帖(片内已标注)
· 数据核对:全部数字取自上述官方页面原文与图表,截至 2026-08-26

数据与排名均来自官方页面原文并逐项核对,图表数字经过双读校验。
BGM:Mining by Moonlight — Kevin MacLeod(incompetech.com,CC BY 4.0)

如有不准确之处,欢迎指出。