NeoMME
单塔多模态多语言文档检索编码器
NeoMME 是 H Company 推出的单塔多模态多语言基础编码器,文本 token 与原始图像块共用同一个双向 Transformer,不使用单独预训练的视觉编码器或因果语言模型。提供 260M 与 800M 规模,支持 16,384 token 上下文与 131,072 词表;检索版 NeoMME-Retriever 一次前向即可同时输出稠密向量与多向量表示,用于文本与页面截图的多模态文档检索
1
2026-09-06
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
NeoMME 是 H Company 推出的单塔多模态多语言基础编码器,文本 token 与原始图像块共用同一个双向 Transformer,不使用单独预训练的视觉编码器或因果语言模型。提供 260M 与 800M 规模,支持 16,384 token 上下文与 131,072 词表;检索版 NeoMME-Retriever 一次前向即可同时输出稠密向量与多向量表示,用于文本与页面截图的多模态文档检索
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-09-06
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-06新工具首发
H Company 发布 NeoMME 单塔多模态编码器系列,含 260M 与 800M 双向 Transformer,文本与 32×32 图像块共用同一塔,取消独立视觉塔和因果解码器;检索版 NeoMME-Retriever 一次前向输出稠密与多向量表示,260M 在 ViDoRe v3 达 0.523 nDCG@10。
NeoMME 常见问题
关于 NeoMME 的定位、核心功能、价格与最近更新。
NeoMME 是什么?
NeoMME 是 H Company 推出的单塔多模态多语言基础编码器,文本 token 与原始图像块共用同一个双向 Transformer,不使用单独预训练的视觉编码器或因果语言模型。提供 260M 与 800M 规模,支持 16,384 token 上下文与 131,072 词表;检索版 NeoMME-Retriever 一次前向即可同时输出稠密向量与多向量表示,用于文本与页面截图的多模态文档检索。
NeoMME 有哪些核心功能?
NeoMME 当前已核验的核心功能包括:文件分析、文本向量化、长文本处理。
NeoMME 如何收费?
AI Equal 当前没有收录 NeoMME 的可验证价格信息。
NeoMME 最近有什么更新?
2026-09-06:H Company 发布 NeoMME 单塔多模态编码器系列,含 260M 与 800M 双向 Transformer,文本与 32×32 图像块共用同一塔,取消独立视觉塔和因果解码器;检索版 NeoMME-Retriever 一次前向输出稠密与多向量表示,260M 在 ViDoRe v3 达 0.523 nDCG@10。