GLM-5.3-Flash

智谱 GLM-5 系列首个原生多模态开源模型,320B 总参 18B 激活

GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署

代码生成图像理解复杂推理文档生成智能体本地模型推理模型推理服务浏览器操作代理第三方应用集成
访问官网
收录动态

7

最近更新

2026-09-29

评价样本

未收录

社区规模

—

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署

核心功能

9 项已整理
代码生成
图像理解
复杂推理
文档生成
智能体
本地模型推理
模型推理服务
浏览器操作代理
第三方应用集成

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-09-29
覆盖行业
程序员

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-09-29功能更新

    GLM-5.3-Flash 新增一条企业级分发渠道:企业团队现可在 OpenAI Codex 中原生调用该模型,消费计入其 OpenAI commit。开发者可在不离开 Codex 的情况下选用该开源模型用于编码任务。

  2. 2026-09-03价格调整

    智谱推出“Flash × ZCode”夜间畅用活动(9月3日至20日每晚23:00-次日9:00),付费套餐用户通过智谱官方工具 ZCode 使用 GLM-5.3-Flash 时额度消耗为0完全免费,通过其他 Agent 使用时额度翻倍(×2),仅针对 GLM-5.3-Flash,错峰时段选用 GLM-5.3 仍按标准规则消耗。

  3. 2026-08-28版本发布

    Databricks 推理团队宣布对 GLM-5.3-Flash 的推理速度达成 270 tok/s,并在其 OfficeQA Pro v2 基准中称该模型以仅 GLM-5.2 的 1/10 成本实现质量高 10% 的表现,突出其推理速度与成本优势。

  4. 2026-08-27功能更新

    摩尔线程官方宣布基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈对 GLM-5.3-Flash 实现 Day-0 极速适配与高效运行,并与 SGLang-MUSA 缓存管理体系深度协同,释放 KDA 长上下文推理效率优势,模型现可在国产硬件上本地部署。

  5. 2026-08-27功能更新

    Z.ai 公布 GLM-5.3-Flash 的 API 具体定价为每百万输入 token 0.15 美元、每百万输出 token 0.50 美元(约为 GLM-5.3 的 1/10),并确认该模型全程运行于国产 AI 芯片而非 Nvidia GPU:基于 SGLang 的自研服务软件把处理拆分成分阶段独立扩展、吞吐较首版提升三倍,日服务约 100 万亿 token,硬件效率与单 token 成本可与常见 Nvidia GPU 对标。

  6. 2026-08-26新工具首发

    智谱上线并开源 GLM-5.3-Flash,GLM-5 系列首个原生多模态模型(320B/18B 激活),采用稀疏+线性注意力混合架构,视觉能力原生融入编码循环并扩展至文档工作流,定价为 GLM-5.3 的 1/10,已接入编码平台并开放 API

  7. 2026-08-26功能更新

    GLM-5.3-Flash上线并由商汤大装置提供国产算力规模化商用支持:依托国产异构混推技术提供Token服务,端到端推理性能较初始基线提升3倍,国产芯片端到端服务硬件效率与单Token成本达到主流英伟达GPU水平。

GLM-5.3-Flash 常见问题

关于 GLM-5.3-Flash 的定位、核心功能、价格与最近更新。

GLM-5.3-Flash 是什么?

GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署。

GLM-5.3-Flash 有哪些核心功能?

GLM-5.3-Flash 当前已核验的核心功能包括:代码生成、图像理解、复杂推理、文档生成、智能体、本地模型推理、模型推理服务、浏览器操作代理、第三方应用集成。

GLM-5.3-Flash 如何收费?

AI Equal 当前没有收录 GLM-5.3-Flash 的可验证价格信息。

GLM-5.3-Flash 最近有什么更新?

2026-09-29:GLM-5.3-Flash 新增一条企业级分发渠道:企业团队现可在 OpenAI Codex 中原生调用该模型,消费计入其 OpenAI commit。开发者可在不离开 Codex 的情况下选用该开源模型用于编码任务。