
Perceptron
面向物理智能体的具身视觉推理模型,可输出点框多边形与视频片段
Perceptron 是面向物理智能体的具身视觉推理模型,为真实世界连续视频流提供感知与推理层。模型接受文本、图像、视频输入,能以点、边界框、多边形和视频片段配合文本作答,支持跨时序推理、视频片段时间码定位、单样本目标检索、手势关键点估计与密集场景计数。开发者可通过 API 调用,企业可申请权重商业许可;Mk1.5 版本已于 2026 年 9 月 25 日上线 OpenRouter
1
2026-09-25
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Perceptron 是面向物理智能体的具身视觉推理模型,为真实世界连续视频流提供感知与推理层。模型接受文本、图像、视频输入,能以点、边界框、多边形和视频片段配合文本作答,支持跨时序推理、视频片段时间码定位、单样本目标检索、手势关键点估计与密集场景计数。开发者可通过 API 调用,企业可申请权重商业许可;Mk1.5 版本已于 2026 年 9 月 25 日上线 OpenRouter
核心功能
价格信息
付费当前仅展示已核验的定价模式。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-09-25
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-25版本发布
Perceptron 面向物理智能体的具身推理模型 Mk1.5 上线 OpenRouter,开发者可经统一 API 调用;该模型接受文本、图像、视频和音频输入,并能以点、边界框、多边形和视频片段配合文本作答。
Perceptron 常见问题
关于 Perceptron 的定位、核心功能、价格与最近更新。
Perceptron 是什么?
Perceptron 是面向物理智能体的具身视觉推理模型,为真实世界连续视频流提供感知与推理层。模型接受文本、图像、视频输入,能以点、边界框、多边形和视频片段配合文本作答,支持跨时序推理、视频片段时间码定位、单样本目标检索、手势关键点估计与密集场景计数。开发者可通过 API 调用,企业可申请权重商业许可;Mk1.5 版本已于 2026 年 9 月 25 日上线 OpenRouter。
Perceptron 有哪些核心功能?
Perceptron 当前已核验的核心功能包括:关键点检测、图像理解、复杂推理、目标检测、视频理解。
Perceptron 如何收费?
Perceptron 当前已核验的价格模式为付费。
Perceptron 最近有什么更新?
2026-09-25:Perceptron 面向物理智能体的具身推理模型 Mk1.5 上线 OpenRouter,开发者可经统一 API 调用;该模型接受文本、图像、视频和音频输入,并能以点、边界框、多边形和视频片段配合文本作答。