STORY · 事件已收束

智谱开放 GLM-5.3-Flash API 调用

6 个精选信源 · 6 篇报道持续 1最新动态 8天前
最新进展

最新报道披露GLM-5.3-Flash线上流量运行在10万颗国产芯片上,Ox Alpha处理了62T token。

DIGEST

事件全貌

AI 综述 · 更新于 8天前

智谱于2026年8月26日上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数量320B、激活参数仅18B,支持1M-token上下文窗口,采用MIT许可证。该模型在AA综合智能指数取得57分,与Claude Opus 4.8持平,编程表现亦相当。

定价方面,GLM-5.3-Flash为GLM-5.3的1/10,限时折扣价为1/20,为Opus 4.8的1/40。模型已接入ZCode等平台,并开放API调用。

该模型此前以Ox Alpha代号在OpenRouter上预览,6天内处理了超过20万亿token,是OpenRouter上有史以来最大的模型。智谱表示模型完全运行于国产AI芯片,采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。

最新报道补充,该模型线上流量完全运行在10万颗国产芯片上,发布前匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token,同样使用中国硬件,供应商可能包括华为、海光和摩尔线程。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

TIMELINE

报道时间线

6 条公开报道 · 官方一手 4 条 · 最新在前
  1. 智谱开源GLM-5.3-Flash,国产芯片驱动
    X:X.PIN (@thexpin)

    智谱于8月26日开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型。其线上流量完全运行在10万颗国产芯片上。发布前,匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token——同样使用中国硬件。据报道,供应商可能包括华为、海光和摩尔线程。该模型在Artificial Analysis上得分为57,与Claude Opus 4.8持平,而成本仅为GLM-5.3的十分之一。开放模型、国产算力、全球需求。

  2. GLM-5.3-Flash:前沿智能进入普惠时代
    智谱:研究(网页内嵌数据)官方一手精选

    智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。

  3. GLM-5.3-Flash 开源:320B 总参数、AA 指数 57 分,定价为 Opus 4.8 的 1/40
    公众号:智谱(GLM)官方一手精选

    智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。其定价为 GLM-5.3 的 1/10,限时折扣内为 Opus 4.8 的 1/40,并已接入 ZCode 等平台开放 API 调用。该模型采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。

  4. OpenRouter 揭晓 GLM-5.3-Flash 多模态模型
    X:OpenRouter (@OpenRouter)官方一手

    Ox Alpha 揭晓:@Zai_org 的 GLM-5.3-Flash,GLM-5 系列中首个原生多模态模型。 Ox Alpha 是 OpenRouter 上有史以来最大的模型,6 天内处理了超过 20 万亿 token。 立即继续使用该模型:https://openrouter.ai/z-ai/glm-5.3-flash

  5. 智谱发布GLM-5.3-Flash,MIT开源320B模型
    X:智谱 Z.ai (@Zai_org)官方一手

    智谱推出GLM-5.3-Flash,原生多模态,支持1M-token上下文窗口,320B-A18B参数,MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线,主打高性价比。

  6. 智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
    IT之家(RSS)

    智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分,与 Claude Opus 4.8 持平,编程表现亦相当;定价为 GLM-5.3 的 1/10,限时折扣为 1/20,为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台,并开放 API 调用。