Ling-3.0-flash

蚂蚁百灵 124B MoE 高速推理模型

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景

长文本处理模型推理服务模型量化压缩
访问官网
收录动态

2

最近更新

2026-08-04

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景

核心功能

3 项已整理
长文本处理
模型推理服务
模型量化压缩

价格信息

免费

当前仅展示已核验的定价模式。

基础信息

更新频率
近 7 天 2 条收录动态
最近更新
2026-08-04
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-08-04开源

    蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。

  2. 2026-08-03价格调整

    蚂蚁百灵官方宓布,OpenRouter 上 Ling-3.0-flash 的免费访问期延长至太平洋时间 8 月 6 日上午 8:00,开发者可在此期间继续通过 OpenRouter 免费调用该 124B MoE 模型(262144 token 上下文)。

Ling-3.0-flash 常见问题

关于 Ling-3.0-flash 的定位、核心功能、价格与最近更新。

Ling-3.0-flash 是什么?

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景。

Ling-3.0-flash 有哪些核心功能?

Ling-3.0-flash 当前已核验的核心功能包括:长文本处理、模型推理服务、模型量化压缩。

Ling-3.0-flash 如何收费?

Ling-3.0-flash 当前已核验的价格模式为免费。

Ling-3.0-flash 最近有什么更新?

2026-08-04:蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。

Ling-3.0-flash:功能、价格、更新日志与同类对比 | AI Equal