GLM-5.3-Flash
智谱 GLM-5 系列首个原生多模态开源模型,320B 总参 18B 激活
GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署
7
2026-09-29
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-09-29
- 覆盖行业
- 程序员
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-29功能更新
GLM-5.3-Flash 新增一条企业级分发渠道:企业团队现可在 OpenAI Codex 中原生调用该模型,消费计入其 OpenAI commit。开发者可在不离开 Codex 的情况下选用该开源模型用于编码任务。
- 2026-09-03价格调整
智谱推出“Flash × ZCode”夜间畅用活动(9月3日至20日每晚23:00-次日9:00),付费套餐用户通过智谱官方工具 ZCode 使用 GLM-5.3-Flash 时额度消耗为0完全免费,通过其他 Agent 使用时额度翻倍(×2),仅针对 GLM-5.3-Flash,错峰时段选用 GLM-5.3 仍按标准规则消耗。
- 2026-08-28版本发布
Databricks 推理团队宣布对 GLM-5.3-Flash 的推理速度达成 270 tok/s,并在其 OfficeQA Pro v2 基准中称该模型以仅 GLM-5.2 的 1/10 成本实现质量高 10% 的表现,突出其推理速度与成本优势。
- 2026-08-27功能更新
摩尔线程官方宣布基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈对 GLM-5.3-Flash 实现 Day-0 极速适配与高效运行,并与 SGLang-MUSA 缓存管理体系深度协同,释放 KDA 长上下文推理效率优势,模型现可在国产硬件上本地部署。
- 2026-08-27功能更新
Z.ai 公布 GLM-5.3-Flash 的 API 具体定价为每百万输入 token 0.15 美元、每百万输出 token 0.50 美元(约为 GLM-5.3 的 1/10),并确认该模型全程运行于国产 AI 芯片而非 Nvidia GPU:基于 SGLang 的自研服务软件把处理拆分成分阶段独立扩展、吞吐较首版提升三倍,日服务约 100 万亿 token,硬件效率与单 token 成本可与常见 Nvidia GPU 对标。
- 2026-08-26新工具首发
智谱上线并开源 GLM-5.3-Flash,GLM-5 系列首个原生多模态模型(320B/18B 激活),采用稀疏+线性注意力混合架构,视觉能力原生融入编码循环并扩展至文档工作流,定价为 GLM-5.3 的 1/10,已接入编码平台并开放 API
- 2026-08-26功能更新
GLM-5.3-Flash上线并由商汤大装置提供国产算力规模化商用支持:依托国产异构混推技术提供Token服务,端到端推理性能较初始基线提升3倍,国产芯片端到端服务硬件效率与单Token成本达到主流英伟达GPU水平。
GLM-5.3-Flash 常见问题
关于 GLM-5.3-Flash 的定位、核心功能、价格与最近更新。
GLM-5.3-Flash 是什么?
GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态开源模型,总参 320B、激活参仅 18B,首次采用稀疏+线性注意力混合架构以降低成本服务长上下文。视觉能力原生融入编码循环,可观察界面与渲染结果持续测试改进,并扩展至 Office、金融研究与专业文档工作流,自研拆解目标、调用工具并交付 PPTX/PDF/DOCX/XLSX 成品,支持 1M token 上下文,可经 Z.ai 与 BigModel 调用或本地部署。
GLM-5.3-Flash 有哪些核心功能?
GLM-5.3-Flash 当前已核验的核心功能包括:代码生成、图像理解、复杂推理、文档生成、智能体、本地模型推理、模型推理服务、浏览器操作代理、第三方应用集成。
GLM-5.3-Flash 如何收费?
AI Equal 当前没有收录 GLM-5.3-Flash 的可验证价格信息。
GLM-5.3-Flash 最近有什么更新?
2026-09-29:GLM-5.3-Flash 新增一条企业级分发渠道:企业团队现可在 OpenAI Codex 中原生调用该模型,消费计入其 OpenAI commit。开发者可在不离开 Codex 的情况下选用该开源模型用于编码任务。