Ling-3.0-tiny
蚂蚁百灵轻量混合推理 MoE 开源模型
Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署
1
2026-08-11
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-08-11
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-08-11开源
蚂蚁百灵在 Hugging Face 开源轻量级混合推理 MoE 模型 Ling-3.0-tiny:总参数 7.9B、每 token 激活 1.3B,KDA 与 MLA 按 3:1 交替堆叠搭配 128 路由专家稀疏 MoE FFN(每 token 激活 8 路由+1 共享专家)。支持快速响应与多步骤推理双模式,可通过 enable_thinking 按请求开关思考;同时提供 BF16、FP8、INT4 三种权重。官方已在 NVIDIA DGX Spark、Apple Silicon MacBook 和 Mac mini 上验证本地部署,FP8 下 DGX Spark 达 100-105 tokens/s、M4 Pro MacBook 达 86-90 tokens/s,8K 上下文峰值内存约 8.34 GiB。
Ling-3.0-tiny 常见问题
关于 Ling-3.0-tiny 的定位、核心功能、价格与最近更新。
Ling-3.0-tiny 是什么?
Ling-3.0-tiny 是蚂蚁百灵(inclusionAI)开源的轻量级混合推理 MoE 模型,总参数 7.9B,每 token 仅激活 1.3B 参数,采用 KDA 与 MLA 按 3:1 交替堆叠加 128 路由专家的稀疏 MoE FFN。支持快速响应与多步骤推理两种模式,可按请求开关思考模式,在智能体任务、代码、数学与科学推理、长上下文理解上表现均衡,并提供 BF16、FP8、INT4 权重,已在 DGX Spark、Apple Silicon MacBook 与 Mac mini 上验证本地部署。
Ling-3.0-tiny 有哪些核心功能?
Ling-3.0-tiny 当前已核验的核心功能包括:代码生成、复杂推理、性能基准、智能体、模型量化压缩、长文本处理。
Ling-3.0-tiny 如何收费?
AI Equal 当前没有收录 Ling-3.0-tiny 的可验证价格信息。
Ling-3.0-tiny 最近有什么更新?
2026-08-11:蚂蚁百灵在 Hugging Face 开源轻量级混合推理 MoE 模型 Ling-3.0-tiny:总参数 7.9B、每 token 激活 1.3B,KDA 与 MLA 按 3:1 交替堆叠搭配 128 路由专家稀疏 MoE FFN(每 token 激活 8 路由+1 共享专家)。支持快速响应与多步骤推理双模式,可通过 enable_thinking 按请求开关思考;同时提供 BF16、FP8、INT4 三种权重。官方已在 NVIDIA DGX Spark、Apple Silicon MacBook 和 Mac mini 上验证本地部署,FP8 下 DGX Spark 达 100-105 tokens/s、M4 Pro MacBook 达 86-90 tokens/s,8K 上下文峰值内存约 8.34 GiB。