Ling-3.0-flash

蚂蚁百灵 124B MoE 高速推理模型

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景

代码生成图像理解复杂推理性能基准文件分析智能体模型推理服务模型训练学习模型量化压缩视频理解长文本处理
访问官网
收录动态

13

最近更新

2026-09-16

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景

核心功能

11 项已整理
代码生成
图像理解
复杂推理
性能基准
文件分析
智能体
模型推理服务
模型训练学习
模型量化压缩
视频理解
长文本处理

价格信息

免费

当前仅展示已核验的定价模式。

基础信息

更新频率
近 7 天 5 条收录动态
最近更新
2026-09-16
覆盖行业
金融

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-09-16功能更新

    Artificial Analysis 公布蚂蚁百灵金融开源权重模型 Ling-3.0-flash-Fin 第三方评测:智能指数 23 分、金融与会计指数 24 分,位于智能-活跃参数帕累托前沿(124B 总参 / 5.1B 激活,256K 上下文,纯文本输入输出,MIT 许可,OpenRouter 提供限速免费端点)。其商业知识准确率 17% 高于 Ling-3.0-flash-VL 的 11%,但非幻觉率更低(67% vs 81%);GDPval-AA v2 得 1171 Elo、AA-Briefcase 得 967 Elo,为金融领域模型选型与对比提供新的第三方基准依据。

  2. 2026-09-11功能更新

    Artificial Analysis 官方 X 账号公布蚂蚁百灵开源权重多模态模型 Ling-3.0-flash-VL 评测结果:智能指数得 25 分,模型 124B 总参 / 5.5B 活跃参数,位于智能-活跃参数帕累托前沿。该官方口径于 2026-09-11 发布,与库存 9 月 9 日开源事件中记录的 42 分形成对照,为模型选型对比提供新的第三方基准数据。

  3. 2026-09-11版本发布

    蚂蚁百灵 Ling-3.0-flash-VL 视觉语言模型两项更新:现已在 OpenRouter 上线并提供两周免费 API 访问;FP4 与 INT4 量化版本同步开源,用户可通过 API 调用或自行部署。

  4. 2026-09-09版本发布

    蚂蚁百灵与推理平台 DeepInfra 达成 day0 合作,Ling-3.0-flash-Fin(金融增强版,256K 上下文,支持财报与申报材料溯源研究、估值建模、表格感知输出)与 Ling-3.0-flash-VL(原生视觉多模态版)两个变体同步上线 DeepInfra,为 OpenRouter 与自托管之外新增官方推理调用渠道。

  5. 2026-09-09开源

    蚂蚁百灵发布并开源首个原生多模态大模型 Ling-3.0-flash-VL:基于 Ling-3.0-flash 的 MoE 架构,总参数 124B、单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口最高 1M token(发布稿称 256K),权重已在 Hugging Face 开放,Artificial Analysis 智能指数 42 分。

  6. 2026-08-28新工具首发

    蚂蚁百灵推出金融增强模型 Ling-3.0-flash-Fin:延续 Ling-3.0-flash 架构(124B 总参 / 5.1B 激活),支持 262,144 token 长上下文,通过金融语料预训练与领域后训练强化对年报、财务工作簿等复杂金融内容处理;将在 OpenRouter 开启为期一个月的限时免费 API 调用,模型权重计划下周开源。

  7. 2026-08-20开源

    蚂蚁百灵正式开源 Ling-3.0-flash-base,并同步开放该模型预训练、中期训练与 WSM 合并三种权重 checkpoint(除最终 Base checkpoint 外共 3 个中间权重),供训练过程研究。

  8. 2026-08-11功能更新

    蚂蚁百灵官方公布 Ling-3.0-flash 单机实测成绩:124B 模型在单台 DGX Spark 上以官方 int4 量化跑出 38.7 tok/s,社区 GGUF 版本为 35.2 tok/s,约为 DeepSeek V4 Flash 同硬件成绩的 2.4 倍;运行时可用完整 256K 上下文,并能在智能体循环中一次性写出可运行代码,被评测者视为单机最快的 124B 级本地模型。

  9. 2026-08-07版本发布

    蚂蚁百灵推出 Ling-3.0-flash 本地部署方案:Hugging Face 上已发布从无损 BF16 到 1-bit 的 GGUF 量化版本及 NVFP4 格式,开发者可在本地硬件运行推理,并获 Atomic Chat 社区首日支持;其中 AD-Q5_K_M 最适合 128GB 硬件(DGX Spark 测试),token 匹配率 97.5%,漂移比同尺寸 llama.cpp 默认量化低 31%。

  10. 2026-08-07功能更新

    Artificial Analysis 公布 Ling 3.0 Flash 第三方评测:该 124B 总参 / 5B 激活开源权重推理模型智能指数得 38 分,较上代 Ling 2.6 Flash 提升 24 分,以更少激活参数追平 MiMo-V2.5 与 Qwen3.6 27B,位于开源权重模型智能-总参数帕累托前沿;262K 上下文、MIT 许可,API 定价输入 $0.075/百万 token、输出 $0.22。

  11. 2026-08-06功能更新

    华为官宣昇腾完成蚂蚁百灵 Ling-3.0-flash 的 0 Day 适配,全面兼容昇腾 A2、A3 系列硬件(A2 需 8 卡、A3 需 4 卡),并同步开放完整部署工程与官方标准化部署方案,开发者可用官方镜像快速拉起推理服务;适配中首次引入 CANN PyPTO 算子编程框框架以缩短融合算子交付周期。

  12. 2026-08-04开源

    蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。

  13. 2026-08-03价格调整

    蚂蚁百灵官方宓布,OpenRouter 上 Ling-3.0-flash 的免费访问期延长至太平洋时间 8 月 6 日上午 8:00,开发者可在此期间继续通过 OpenRouter 免费调用该 124B MoE 模型(262144 token 上下文)。

Ling-3.0-flash 常见问题

关于 Ling-3.0-flash 的定位、核心功能、价格与最近更新。

Ling-3.0-flash 是什么?

Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景。

Ling-3.0-flash 有哪些核心功能?

Ling-3.0-flash 当前已核验的核心功能包括:代码生成、图像理解、复杂推理、性能基准、文件分析、智能体、模型推理服务、模型训练学习、模型量化压缩、视频理解、长文本处理。

Ling-3.0-flash 如何收费?

Ling-3.0-flash 当前已核验的价格模式为免费。

Ling-3.0-flash 最近有什么更新?

2026-09-16:Artificial Analysis 公布蚂蚁百灵金融开源权重模型 Ling-3.0-flash-Fin 第三方评测:智能指数 23 分、金融与会计指数 24 分,位于智能-活跃参数帕累托前沿(124B 总参 / 5.1B 激活,256K 上下文,纯文本输入输出,MIT 许可,OpenRouter 提供限速免费端点)。其商业知识准确率 17% 高于 Ling-3.0-flash-VL 的 11%,但非幻觉率更低(67% vs 81%);GDPval-AA v2 得 1171 Elo、AA-Briefcase 得 967 Elo,为金融领域模型选型与对比提供新的第三方基准依据。

Ling-3.0-flash:功能、价格、更新日志与同类对比 | AI Equal