Ling-3.0-tiny

蚂蚁百灵轻量混合推理 MoE 开源模型

Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署

代码生成复杂推理性能基准智能体模型量化压缩长文本处理
访问官网
收录动态

1

最近更新

2026-08-11

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署

核心功能

6 项已整理
代码生成
复杂推理
性能基准
智能体
模型量化压缩
长文本处理

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-08-11
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-08-11开源

    蚂蚁百灵在 Hugging Face 开源轻量级混合推理 MoE 模型 Ling-3.0-tiny:总参数 7.9B、每 token 激活 1.3B,KDA 与 MLA 按 3:1 交替堆叠搭配 128 路由专家稀疏 MoE FFN(每 token 激活 8 路由+1 共享专家)。支持快速响应与多步骤推理双模式,可通过 enable_thinking 按请求开关思考;同时提供 BF16、FP8、INT4 三种权重。官方已在 NVIDIA DGX Spark、Apple Silicon MacBook 和 Mac mini 上验证本地部署,FP8 下 DGX Spark 达 100-105 tokens/s、M4 Pro MacBook 达 86-90 tokens/s,8K 上下文峰值内存约 8.34 GiB。

Ling-3.0-tiny 常见问题

关于 Ling-3.0-tiny 的定位、核心功能、价格与最近更新。

Ling-3.0-tiny 是什么?

Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署。

Ling-3.0-tiny 有哪些核心功能?

Ling-3.0-tiny 当前已核验的核心功能包括:代码生成、复杂推理、性能基准、智能体、模型量化压缩、长文本处理。

Ling-3.0-tiny 如何收费?

AI Equal 当前没有收录 Ling-3.0-tiny 的可验证价格信息。

Ling-3.0-tiny 最近有什么更新?

2026-08-11:蚂蚁百灵在 Hugging Face 开源轻量级混合推理 MoE 模型 Ling-3.0-tiny:总参数 7.9B、每 token 激活 1.3B,KDA 与 MLA 按 3:1 交替堆叠搭配 128 路由专家稀疏 MoE FFN(每 token 激活 8 路由+1 共享专家)。支持快速响应与多步骤推理双模式,可通过 enable_thinking 按请求开关思考;同时提供 BF16、FP8、INT4 三种权重。官方已在 NVIDIA DGX Spark、Apple Silicon MacBook 和 Mac mini 上验证本地部署,FP8 下 DGX Spark 达 100-105 tokens/s、M4 Pro MacBook 达 86-90 tokens/s,8K 上下文峰值内存约 8.34 GiB。