Mixture-of-Kittens

面向 NVL72 的确定性 MoE 训练超内核

Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码

模型训练学习性能基准
访问官网
收录动态

1

最近更新

2026-08-04

评价样本

未收录

GitHub Stars

139

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码

核心功能

2 项已整理
模型训练学习
性能基准

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-08-04
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-08-04开源

    Cursor 开源面向 GB200/GB300 NVL72 的 MoE 训练超内核 Mixture-of-Kittens(MoK):将全部混合专家通信与计算融合进单一完全确定性内核,消除 CPU-GPU 同步,支持 BF16 与 MXFP8 及前向/反向传播,MXFP8 前向比最快公开基线快 2.37 倍,已支撑 Composer 在数万张 GPU 上的生产训练。

Mixture-of-Kittens 常见问题

关于 Mixture-of-Kittens 的定位、核心功能、价格与最近更新。

Mixture-of-Kittens 是什么?

Mixture-of-Kittens(MoK)是 Cursor 开源的混合专家(MoE)训练超内核,专为 GB200/GB300 NVL72 机架从零设计。它把 MoE 的全部计算与跨 GPU 通信融合进单一完全确定性内核,可配置粒度重叠计算与网络传输,并彻底消除 CPU-GPU 同步;支持 BF16 与 MXFP8、覆盖前向与反向传播,已在数万张 GPU 上支撑 Composer 模型的生产训练,附带可复现的基准测试代码。

Mixture-of-Kittens 有哪些核心功能?

Mixture-of-Kittens 当前已核验的核心功能包括:模型训练学习、性能基准。

Mixture-of-Kittens 如何收费?

AI Equal 当前没有收录 Mixture-of-Kittens 的可验证价格信息。

Mixture-of-Kittens 最近有什么更新?

2026-08-04:Cursor 开源面向 GB200/GB300 NVL72 的 MoE 训练超内核 Mixture-of-Kittens(MoK):将全部混合专家通信与计算融合进单一完全确定性内核,消除 CPU-GPU 同步,支持 BF16 与 MXFP8 及前向/反向传播,MXFP8 前向比最快公开基线快 2.37 倍,已支撑 Composer 在数万张 GPU 上的生产训练。