llama.cpp

C/C++ 本地大模型推理引擎,一套二进制通吃各类硬件

llama.cpp 是用 C/C++ 实现的大语言模型本地推理引擎,官方主页为 llama.app,代码以 MIT 许可托管于 GitHub(ggml-org/llama.cpp)。它通过 llama serve 在本机提供模型服务,请求与文件都留在设备上,无需 API 密钥。项目针对各类硬件手工调优内核,从笔记本到集群、从 Apple Silicon 到 NVIDIA、AMD、Intel GPU 与纯 CPU 均可用同一二进制文件运行,并提供模型库与安装、构建文档

模型推理服务
访问官网
收录动态

0

最近更新

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

llama.cpp 是用 C/C++ 实现的大语言模型本地推理引擎,官方主页为 llama.app,代码以 MIT 许可托管于 GitHub(ggml-org/llama.cpp)。它通过 llama serve 在本机提供模型服务,请求与文件都留在设备上,无需 API 密钥。项目针对各类硬件手工调优内核,从笔记本到集群、从 Apple Silicon 到 NVIDIA、AMD、Intel GPU 与纯 CPU 均可用同一二进制文件运行,并提供模型库与安装、构建文档

核心功能

1 项已整理
模型推理服务

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
暂无已发布动态
最近更新
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

暂无可展示的更新历史

采集到并通过审核的功能动态会按时间显示在这里。

llama.cpp 常见问题

关于 llama.cpp 的定位、核心功能、价格与最近更新。

llama.cpp 是什么?

llama.cpp 是用 C/C++ 实现的大语言模型本地推理引擎,官方主页为 llama.app,代码以 MIT 许可托管于 GitHub(ggml-org/llama.cpp)。它通过 llama serve 在本机提供模型服务,请求与文件都留在设备上,无需 API 密钥。项目针对各类硬件手工调优内核,从笔记本到集群、从 Apple Silicon 到 NVIDIA、AMD、Intel GPU 与纯 CPU 均可用同一二进制文件运行,并提供模型库与安装、构建文档。

llama.cpp 有哪些核心功能?

llama.cpp 当前已核验的核心功能包括:模型推理服务。

llama.cpp 如何收费?

AI Equal 当前没有收录 llama.cpp 的可验证价格信息。