private-gpt
社区使用中by zylon-ai
PrivateGPT 是一个开源 API 层,将本地模型转化为生产级 AI 应用,提供 RAG、工具调用、MCP 连接器、text-to-sql 等能力。它本身不运行模型,而是通过 OpenAI 兼容接口连接 Ollama、vLLM 等推理服务器,并遵循 Claude API 规范,适合构建私有化、本地部署的 AI 产品。
安装配置
将以下配置添加到你的 AI 编程助手中
预览配置(粘贴到 claude_desktop_config.json 或 Cursor 设置中)
{
"mcpServers": {
"private-gpt": {}
}
}JSON配置
{}描述

PrivateGPT 是一个开源 API 层,可将本地模型转化为生产级 AI 应用。
在本地运行模型只是第一步。要构建实用的 AI 应用,你需要一组更高级别的构建模块。PrivateGPT 以开源 API 的形式提供这一层,遵循 Claude API 模型——这样你就可以构建私有的 AI 产品,而无需从头重建相同的后端原语,也无需依赖云 API。
经过生产环境验证:PrivateGPT 为 Zylon 提供支持,Zylon 是为全球企业提供私有 AI 的本地部署 AI 平台。
你的应用 / 代理 / 工作流 / UI
|
PrivateGPT API
|
OpenAI 兼容推理服务器(Ollama、llama.cpp、vLLM 等)
PrivateGPT 不直接运行模型。它通过
OPENAI_API_BASE连接到任何 OpenAI 兼容的推理服务器。只要该服务器实现了/v1/chat/completions和/v1/models,就可以正常工作。
PrivateGPT 附带一个内置的工作台 UI,用于测试和演示,可在 /ui 访问。API 才是真正的产品。
PrivateGPT 提供的能力
- 标准消息 API(流式、异步、token 计数)
- 文件和工件摄取
- 带引用的检索和代理式 RAG
- 内置工具,镜像 Claude API(网络搜索、网页抓取、代码执行)
- 自定义工具和 MCP 连接器
- 对数据库和 CSV 的结构化访问
- 嵌入和编排
快速开始
有关 Docker、完整安装选项和模型配置,请参阅完整快速入门指南。
前置条件: 你需要一个正在运行的 OpenAI 兼容 LLM 服务器。Ollama 是最简单的入门方式。
1. 安装 PrivateGPT
# macOS
brew tap zylon-ai/tap
brew install private-gpt
# Linux
curl -LsSf https://astral.sh/uv/install.sh | sh
uv tool install --python 3.11 \
--find-links https://wheels.privategpt.dev/packages/ \
"private-gpt[core]"
# Windows
powershell -ExecutionPolicy ByPass -c "irm https://astral.sh/uv/install.ps1 | iex"
uv tool install --python 3.11 `
--find-links https://wheels.privategpt.dev/packages/ `
"private-gpt[core]"
2. 启动你的 LLM 服务器
# 以 Ollama 为例
ollama pull qwen3.5:35b # LLM(约 24 GB)
ollama pull mxbai-embed-large # 嵌入模型(约 670 MB)
ollama serve
3. 运行 PrivateGPT
# macOS / Linux
OPENAI_API_BASE=http://localhost:<llm-port>/v1 \
OPENAI_EMBEDDING_API_BASE=http://localhost:<embedding-port>/v1 \
private-gpt serve
# Windows(PowerShell)
$env:OPENAI_API_BASE = "http://localhost:<llm-port>/v1"
$env:OPENAI_EMBEDDING_API_BASE = "http://localhost:<embedding-port>/v1"
private-gpt serve
4. 打开 UI
访问 http://localhost:8080/ui。API 位于 http://localhost:8080,遵循 Anthropic API 规范。
该 UI 可用于:
- 发送消息。
- 从 /v1/models 选择模型。
- 上传文档。
- 测试带引用的检索。
- 按聊天启用工具。
- 配置数据库、MCP 连接器、技能和自定义工具。
- 通过 API 调试器检查请求和响应。
此 UI 是一个演示工具,而非核心产品。开发者应在 API 之上构建自己的应用。尽管如此,该 UI 经过精心打磨,足以用于演示、视频、内部试点和快速本地使用。
集成
| | | |
|:-------------------------:|:-------------------------:|:-------------------------:|
|
Claude Desktop / Cowork|
Microsoft Excel Claude 加载项|[![ms word claude]…
统计信息
57k
星标
7.6k
Fork
Python
语言
2026/8/15
更新
Apache-2.0
开源协议
标签
相关服务器
MODULAR-RAG-MCP-SERVER
MODULAR-RAG-MCP-SERVER 是一个可插拔、可观测的模块化 RAG(检索增强生成)服务框架,通过 MCP 协议对外暴露工具接口,支持 Copilot、Claude 等 AI 助手直接调用。项目涵盖混合检索、多模态图像处理、RAG 评估与全链路追踪等核心能力,并内置 Skill 驱动开发流程,适合作为大模型岗位的学习与面试实战项目。
headroom
Headroom 是一个面向 AI Agent 的上下文压缩层,可在内容到达 LLM 之前压缩工具输出、日志、文件、RAG 块及对话历史,在保持答案质量的前提下显著减少 token 消耗(JSON 数据可减少 60-95%,编码 Agent 减少 15-20%)。它以 Python/TypeScript 库、代理服务器、MCP server 及命令行包装器等多种形式提供,支持
anki-mcp-server
anki-mcp-server 是一个基于 Model Context Protocol (MCP) 的服务器,使 AI 助手能够与 Anki 间隔重复闪卡应用进行交互。它提供 42 个 MCP 工具,涵盖复习、卡片管理、笔记编辑等操作,支持自然语言驱动的个性化学习体验,并可与 Claude Desktop 等 AI 客户端集成。该项目处于 Beta 阶段,适合希望将 AI 能
SurfSense
SurfSense 是一款开源的 NotebookLM 替代品,专为 AI agents 设计,提供开放网络研究平台。它通过统一的 REST API 或 MCP server 连接 Reddit、YouTube、Instagram、Google Search 等实时数据源,返回结构化 JSON 数据,并内置知识库、引用检索与自动化报告功能。项目支持自托管,适合需要实时网络数据与