
Mixture-of-Kittens
面向 NVL72 的确定性 MoE 训练超内核
Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码
1
2026-08-04
未收录
139
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-08-04
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-08-04开源
Cursor 开源面向 GB200/GB300 NVL72 的 MoE 训练超内核 Mixture-of-Kittens(MoK):将全部混合专家通信与计算融合进单一完全确定性内核,消除 CPU-GPU 同步,支持 BF16 与 MXFP8 及前向/反向传播,MXFP8 前向比最快公开基线快 2.37 倍,已支撑 Composer 在数万张 GPU 上的生产训练。
Mixture-of-Kittens 常见问题
关于 Mixture-of-Kittens 的定位、核心功能、价格与最近更新。
Mixture-of-Kittens 是什么?
Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码。
Mixture-of-Kittens 有哪些核心功能?
Mixture-of-Kittens 当前已核验的核心功能包括:模型训练学习、性能基准。
Mixture-of-Kittens 如何收费?
AI Equal 当前没有收录 Mixture-of-Kittens 的可验证价格信息。
Mixture-of-Kittens 最近有什么更新?
2026-08-04:Cursor 开源面向 GB200/GB300 NVL72 的 MoE 训练超内核 Mixture-of-Kittens(MoK):将全部混合专家通信与计算融合进单一完全确定性内核,消除 CPU-GPU 同步,支持 BF16 与 MXFP8 及前向/反向传播,MXFP8 前向比最快公开基线快 2.37 倍,已支撑 Composer 在数万张 GPU 上的生产训练。