Ling-3.0-flash
蚂蚁百灵 124B MoE 高速推理模型
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景
2
2026-08-04
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景
核心功能
价格信息
免费当前仅展示已核验的定价模式。
基础信息
- 更新频率
- 近 7 天 2 条收录动态
- 最近更新
- 2026-08-04
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-08-04开源
蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。
- 2026-08-03价格调整
蚂蚁百灵官方宓布,OpenRouter 上 Ling-3.0-flash 的免费访问期延长至太平洋时间 8 月 6 日上午 8:00,开发者可在此期间继续通过 OpenRouter 免费调用该 124B MoE 模型(262144 token 上下文)。
Ling-3.0-flash 常见问题
关于 Ling-3.0-flash 的定位、核心功能、价格与最近更新。
Ling-3.0-flash 是什么?
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景。
Ling-3.0-flash 有哪些核心功能?
Ling-3.0-flash 当前已核验的核心功能包括:长文本处理、模型推理服务、模型量化压缩。
Ling-3.0-flash 如何收费?
Ling-3.0-flash 当前已核验的价格模式为免费。
Ling-3.0-flash 最近有什么更新?
2026-08-04:蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。