Ling-3.0-flash
蚂蚁百灵 124B MoE 高速推理模型
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景
13
2026-09-16
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景
核心功能
价格信息
免费当前仅展示已核验的定价模式。
基础信息
- 更新频率
- 近 7 天 5 条收录动态
- 最近更新
- 2026-09-16
- 覆盖行业
- 金融
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-16功能更新
Artificial Analysis 公布蚂蚁百灵金融开源权重模型 Ling-3.0-flash-Fin 第三方评测:智能指数 23 分、金融与会计指数 24 分,位于智能-活跃参数帕累托前沿(124B 总参 / 5.1B 激活,256K 上下文,纯文本输入输出,MIT 许可,OpenRouter 提供限速免费端点)。其商业知识准确率 17% 高于 Ling-3.0-flash-VL 的 11%,但非幻觉率更低(67% vs 81%);GDPval-AA v2 得 1171 Elo、AA-Briefcase 得 967 Elo,为金融领域模型选型与对比提供新的第三方基准依据。
- 2026-09-11功能更新
Artificial Analysis 官方 X 账号公布蚂蚁百灵开源权重多模态模型 Ling-3.0-flash-VL 评测结果:智能指数得 25 分,模型 124B 总参 / 5.5B 活跃参数,位于智能-活跃参数帕累托前沿。该官方口径于 2026-09-11 发布,与库存 9 月 9 日开源事件中记录的 42 分形成对照,为模型选型对比提供新的第三方基准数据。
- 2026-09-11版本发布
蚂蚁百灵 Ling-3.0-flash-VL 视觉语言模型两项更新:现已在 OpenRouter 上线并提供两周免费 API 访问;FP4 与 INT4 量化版本同步开源,用户可通过 API 调用或自行部署。
- 2026-09-09版本发布
蚂蚁百灵与推理平台 DeepInfra 达成 day0 合作,Ling-3.0-flash-Fin(金融增强版,256K 上下文,支持财报与申报材料溯源研究、估值建模、表格感知输出)与 Ling-3.0-flash-VL(原生视觉多模态版)两个变体同步上线 DeepInfra,为 OpenRouter 与自托管之外新增官方推理调用渠道。
- 2026-09-09开源
蚂蚁百灵发布并开源首个原生多模态大模型 Ling-3.0-flash-VL:基于 Ling-3.0-flash 的 MoE 架构,总参数 124B、单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口最高 1M token(发布稿称 256K),权重已在 Hugging Face 开放,Artificial Analysis 智能指数 42 分。
- 2026-08-28新工具首发
蚂蚁百灵推出金融增强模型 Ling-3.0-flash-Fin:延续 Ling-3.0-flash 架构(124B 总参 / 5.1B 激活),支持 262,144 token 长上下文,通过金融语料预训练与领域后训练强化对年报、财务工作簿等复杂金融内容处理;将在 OpenRouter 开启为期一个月的限时免费 API 调用,模型权重计划下周开源。
- 2026-08-20开源
蚂蚁百灵正式开源 Ling-3.0-flash-base,并同步开放该模型预训练、中期训练与 WSM 合并三种权重 checkpoint(除最终 Base checkpoint 外共 3 个中间权重),供训练过程研究。
- 2026-08-11功能更新
蚂蚁百灵官方公布 Ling-3.0-flash 单机实测成绩:124B 模型在单台 DGX Spark 上以官方 int4 量化跑出 38.7 tok/s,社区 GGUF 版本为 35.2 tok/s,约为 DeepSeek V4 Flash 同硬件成绩的 2.4 倍;运行时可用完整 256K 上下文,并能在智能体循环中一次性写出可运行代码,被评测者视为单机最快的 124B 级本地模型。
- 2026-08-07版本发布
蚂蚁百灵推出 Ling-3.0-flash 本地部署方案:Hugging Face 上已发布从无损 BF16 到 1-bit 的 GGUF 量化版本及 NVFP4 格式,开发者可在本地硬件运行推理,并获 Atomic Chat 社区首日支持;其中 AD-Q5_K_M 最适合 128GB 硬件(DGX Spark 测试),token 匹配率 97.5%,漂移比同尺寸 llama.cpp 默认量化低 31%。
- 2026-08-07功能更新
Artificial Analysis 公布 Ling 3.0 Flash 第三方评测:该 124B 总参 / 5B 激活开源权重推理模型智能指数得 38 分,较上代 Ling 2.6 Flash 提升 24 分,以更少激活参数追平 MiMo-V2.5 与 Qwen3.6 27B,位于开源权重模型智能-总参数帕累托前沿;262K 上下文、MIT 许可,API 定价输入 $0.075/百万 token、输出 $0.22。
- 2026-08-06功能更新
华为官宣昇腾完成蚂蚁百灵 Ling-3.0-flash 的 0 Day 适配,全面兼容昇腾 A2、A3 系列硬件(A2 需 8 卡、A3 需 4 卡),并同步开放完整部署工程与官方标准化部署方案,开发者可用官方镜像快速拉起推理服务;适配中首次引入 CANN PyPTO 算子编程框框架以缩短融合算子交付周期。
- 2026-08-04开源
蚂蚁百灵(@AntLingAGI)于 2026-08-04 发布 Ling-3.0-flash 开源权重,同时提供官方 BF16 与 FP8 量化两种版本,开发者可根据自身硬件、性能要求和部署需求选择适合的权重版本自行部署推理。
- 2026-08-03价格调整
蚂蚁百灵官方宓布,OpenRouter 上 Ling-3.0-flash 的免费访问期延长至太平洋时间 8 月 6 日上午 8:00,开发者可在此期间继续通过 OpenRouter 免费调用该 124B MoE 模型(262144 token 上下文)。
Ling-3.0-flash 常见问题
关于 Ling-3.0-flash 的定位、核心功能、价格与最近更新。
Ling-3.0-flash 是什么?
Ling-3.0-flash 是蚂蚁百灵(inclusionAI)推出的混合专家(MoE)大模型,总参数约 1240 亿,每 token 激活约 51 亿参数,支持 262144 token 上下文窗口、单次最大输出 32768 token。该模型已上架 OpenRouter,可通过统一 API 免费调用,适合需要长上下文与低成本推理的开发场景。
Ling-3.0-flash 有哪些核心功能?
Ling-3.0-flash 当前已核验的核心功能包括:代码生成、图像理解、复杂推理、性能基准、文件分析、智能体、模型推理服务、模型训练学习、模型量化压缩、视频理解、长文本处理。
Ling-3.0-flash 如何收费?
Ling-3.0-flash 当前已核验的价格模式为免费。
Ling-3.0-flash 最近有什么更新?
2026-09-16:Artificial Analysis 公布蚂蚁百灵金融开源权重模型 Ling-3.0-flash-Fin 第三方评测:智能指数 23 分、金融与会计指数 24 分,位于智能-活跃参数帕累托前沿(124B 总参 / 5.1B 激活,256K 上下文,纯文本输入输出,MIT 许可,OpenRouter 提供限速免费端点)。其商业知识准确率 17% 高于 Ling-3.0-flash-VL 的 11%,但非幻觉率更低(67% vs 81%);GDPval-AA v2 得 1171 Elo、AA-Briefcase 得 967 Elo,为金融领域模型选型与对比提供新的第三方基准依据。