Nemotron 3 Embed 是 NVIDIA 推出的开源多语言文本嵌入模型集合,包含 8B、1B-BF16 和 1B-NVFP4 三个检查点,支持 34 种语言,在 RTEB 多语言排行榜上 8B 模型以 78.46 平均 NDCG@10 位列第一,适用于检索增强生成(RAG)、语义搜索和多语言问答系统,采用 OpenMDW 许可证可商用。
企业搜索文本向量化智能体
近7天 2 动态
Capability Timeline
将文本转换为稠密向量嵌入,用于检索、语义搜索和RAG系统的基础组件
Nemotron 3 Embed 是 NVIDIA 推出的开源多语言文本嵌入模型集合,包含 8B、1B-BF16 和 1B-NVFP4 三个检查点,支持 34 种语言,在 RTEB 多语言排行榜上 8B 模型以 78.46 平均 NDCG@10 位列第一,适用于检索增强生成(RAG)、语义搜索和多语言问答系统,采用 OpenMDW 许可证可商用。
jllm 是一款面向 Java 开发者的极简本地大语言模型管理器,定位 Ollama 替代品。它通过 JNI 直接绑定 llama.cpp 实现进程内推理,提供 GGUF 模型注册与管理、交互式对话及 HTTP API 服务;内置基于 Apache Lucene 的本地 RAG,可索引 PDF 与文本文件并完全离线检索;还支持插件扩展架构(JAR 插件增加 function-calling 工具与提示拦截器)以及 Embeddings 向量生成 API。全部操作均在本地完成,无外部调用与数据追踪。