A
程序员努力
AI导航AI编程实战PromptMCP市场Skills市场

程序员努力

AI 编程资源库 - 聚合 AI 编程教程、提示词、MCP 与 Skills 资源

内容栏目

  • AI导航
  • AI编程实战
  • Prompt
  • MCP市场
  • Skills市场
  • 全站搜索

教程分类

  • 进阶技巧
  • 入门指南
  • 最佳实践
  • Claude Code
  • Cline教程
  • GitHub Copilot
  • Cursor教程
  • 提示词工程

关于

  • 关于我们
  • GitHub

© 2026 程序员努力. All rights reserved.

← 返回MCP市场
p

private-gpt

社区使用中

by zylon-ai

PrivateGPT 是一个开源 API 层,将本地模型转化为生产级 AI 应用,提供 RAG、工具调用、MCP 连接器、text-to-sql 等能力。它本身不运行模型,而是通过 OpenAI 兼容接口连接 Ollama、vLLM 等推理服务器,并遵循 Claude API 规范,适合构建私有化、本地部署的 AI 产品。

AI/MLStdio(本地命令行)Python

安装配置

将以下配置添加到你的 AI 编程助手中

预览配置(粘贴到 claude_desktop_config.json 或 Cursor 设置中)

{
  "mcpServers": {
    "private-gpt": {}
  }
}

JSON配置

{}

描述

Banner image

PrivateGPT 是一个开源 API 层,可将本地模型转化为生产级 AI 应用。

Tests Website Discord X (formerly Twitter) Follow


在本地运行模型只是第一步。要构建实用的 AI 应用,你需要一组更高级别的构建模块。PrivateGPT 以开源 API 的形式提供这一层,遵循 Claude API 模型——这样你就可以构建私有的 AI 产品,而无需从头重建相同的后端原语,也无需依赖云 API。

经过生产环境验证:PrivateGPT 为 Zylon 提供支持,Zylon 是为全球企业提供私有 AI 的本地部署 AI 平台。

你的应用 / 代理 / 工作流 / UI
              |
        PrivateGPT API
              |
OpenAI 兼容推理服务器(Ollama、llama.cpp、vLLM 等)

PrivateGPT 不直接运行模型。它通过 OPENAI_API_BASE 连接到任何 OpenAI 兼容的推理服务器。只要该服务器实现了 /v1/chat/completions 和 /v1/models,就可以正常工作。

PrivateGPT 附带一个内置的工作台 UI,用于测试和演示,可在 /ui 访问。API 才是真正的产品。


PrivateGPT 提供的能力

  • 标准消息 API(流式、异步、token 计数)
  • 文件和工件摄取
  • 带引用的检索和代理式 RAG
  • 内置工具,镜像 Claude API(网络搜索、网页抓取、代码执行)
  • 自定义工具和 MCP 连接器
  • 对数据库和 CSV 的结构化访问
  • 嵌入和编排

快速开始

有关 Docker、完整安装选项和模型配置,请参阅完整快速入门指南。

前置条件: 你需要一个正在运行的 OpenAI 兼容 LLM 服务器。Ollama 是最简单的入门方式。

1. 安装 PrivateGPT

# macOS
brew tap zylon-ai/tap
brew install private-gpt
# Linux
curl -LsSf https://astral.sh/uv/install.sh | sh

uv tool install --python 3.11 \
  --find-links https://wheels.privategpt.dev/packages/ \
  "private-gpt[core]"
# Windows
powershell -ExecutionPolicy ByPass -c "irm https://astral.sh/uv/install.ps1 | iex"

uv tool install --python 3.11 `
  --find-links https://wheels.privategpt.dev/packages/ `
  "private-gpt[core]"

2. 启动你的 LLM 服务器

# 以 Ollama 为例
ollama pull qwen3.5:35b         # LLM(约 24 GB)
ollama pull mxbai-embed-large   # 嵌入模型(约 670 MB)
ollama serve

3. 运行 PrivateGPT

# macOS / Linux
OPENAI_API_BASE=http://localhost:<llm-port>/v1 \
  OPENAI_EMBEDDING_API_BASE=http://localhost:<embedding-port>/v1 \
  private-gpt serve
# Windows(PowerShell)
$env:OPENAI_API_BASE = "http://localhost:<llm-port>/v1"
$env:OPENAI_EMBEDDING_API_BASE = "http://localhost:<embedding-port>/v1"
private-gpt serve

4. 打开 UI

访问 http://localhost:8080/ui。API 位于 http://localhost:8080,遵循 Anthropic API 规范。

该 UI 可用于:

  • 发送消息。
  • 从 /v1/models 选择模型。
  • 上传文档。
  • 测试带引用的检索。
  • 按聊天启用工具。
  • 配置数据库、MCP 连接器、技能和自定义工具。
  • 通过 API 调试器检查请求和响应。

此 UI 是一个演示工具,而非核心产品。开发者应在 API 之上构建自己的应用。尽管如此,该 UI 经过精心打磨,足以用于演示、视频、内部试点和快速本地使用。


集成

| | | | |:-------------------------:|:-------------------------:|:-------------------------:| |claude coworkClaude Desktop / Cowork|ms excel claudeMicrosoft Excel Claude 加载项|[![ms word claude]…

统计信息

57k

星标

7.6k

Fork

Python

语言

2026/8/14

更新

Apache-2.0

开源协议

标签

本地AIAPI层RAGMCP私有化部署开源

链接

主页GitHubApache-2.0

相关服务器

h

headroom

Headroom 是一个面向 AI Agent 的上下文压缩层,可在内容到达 LLM 之前压缩工具输出、日志、文件、RAG 块及对话历史,在保持答案质量的前提下显著减少 token 消耗(JSON 数据可减少 60-95%,编码 Agent 减少 15-20%)。它以 Python/TypeScript 库、代理服务器、MCP server 及命令行包装器等多种形式提供,支持

AI/MLStdio66k
S

SurfSense

SurfSense 是一款开源的 NotebookLM 替代品,专为 AI agents 设计,提供开放网络研究平台。它通过统一的 REST API 或 MCP server 连接 Reddit、YouTube、Instagram、Google Search 等实时数据源,返回结构化 JSON 数据,并内置知识库、引用检索与自动化报告功能。项目支持自托管,适合需要实时网络数据与

AI/MLStdio16k
a

activepieces

Activepieces 是一个开源的全能 AI 自动化平台,可作为 Zapier 的替代品,提供直观的无代码工作流构建体验。它内置 400 多个 MCP servers,支持将 TypeScript 编写的 pieces 自动暴露为 MCP 工具,供 Claude Desktop、Cursor 或 Windsurf 等 LLM 客户端调用。平台具备 AI-First 特性、企

自动化Stdio24k
l

linkedin-mcp-server

linkedin-mcp-server 是一个开源的 MCP server,允许 Claude 等 MCP 兼容 AI 代理通过用户已登录的浏览器会话访问 LinkedIn 数据,包括个人资料、公司信息、职位搜索和消息。该项目独立于 LinkedIn 官方,支持通过 uvx、Docker 或本地方式快速部署,为 AI 助手提供便捷的 LinkedIn 数据读取能力。

通讯Stdio3.1k