TuringViT
小鹏开源的高效视觉编码器,低成本训练 SOTA 级 ViT
TuringViT 是小鹏基础模型团队发布的高效视觉 Transformer 编码器,通过 Turing 线性注意力架构、VISTA-Curation 数据治理流水线与原生动态分辨率训练,仅用主流基线 10% 的图文数据即可达到 SOTA 级零样本性能,并在高分辨率输入下显著降低推理延迟。提供 18L 与 24L 两个规格,面向 VLM/VLA 下游场景,支撑智能驾驶、智能座舱与 IRON 人形机器人感知
1
2026-07-21
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
TuringViT 是小鹏基础模型团队发布的高效视觉 Transformer 编码器,通过 Turing 线性注意力架构、VISTA-Curation 数据治理流水线与原生动态分辨率训练,仅用主流基线 10% 的图文数据即可达到 SOTA 级零样本性能,并在高分辨率输入下显著降低推理延迟。提供 18L 与 24L 两个规格,面向 VLM/VLA 下游场景,支撑智能驾驶、智能座舱与 IRON 人形机器人感知
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-07-21
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-07-21新工具首发
小鹏集团发布 TuringViT 高效视觉编码器,推出 18L 与 24L 两个规格,采用线性注意力架构与 VISTA-Curation 数据治理,仅用 0.85B 图文对即在六项零样本分类基准取得 83.6% 平均准确率,1536 分辨率下推理吞吐达 Seed1.5-ViT 的 3.04 倍,将支撑智能驾驶、智能座舱与 IRON 人形机器人。
TuringViT 常见问题
关于 TuringViT 的定位、核心功能、价格与最近更新。
TuringViT 是什么?
TuringViT 是小鹏基础模型团队发布的高效视觉 Transformer 编码器,通过 Turing 线性注意力架构、VISTA-Curation 数据治理流水线与原生动态分辨率训练,仅用主流基线 10% 的图文数据即可达到 SOTA 级零样本性能,并在高分辨率输入下显著降低推理延迟。提供 18L 与 24L 两个规格,面向 VLM/VLA 下游场景,支撑智能驾驶、智能座舱与 IRON 人形机器人感知。
TuringViT 有哪些核心功能?
TuringViT 当前已核验的核心功能包括:模型训练学习、图像理解。
TuringViT 如何收费?
AI Equal 当前没有收录 TuringViT 的可验证价格信息。
TuringViT 最近有什么更新?
2026-07-21:小鹏集团发布 TuringViT 高效视觉编码器,推出 18L 与 24L 两个规格,采用线性注意力架构与 VISTA-Curation 数据治理,仅用 0.85B 图文对即在六项零样本分类基准取得 83.6% 平均准确率,1536 分辨率下推理吞吐达 Seed1.5-ViT 的 3.04 倍,将支撑智能驾驶、智能座舱与 IRON 人形机器人。