主权知识库——文档导入、向量嵌入、RAG 检索、模型无关推理。面向业务负责人,无需技术背景。
最后更新:2026-07-09Vault 是一个自托管知识库,利用 AI 帮助您从文档中查找信息。它就像为公司内部知识打造的功能强大的搜索引擎。
工作原理如下:
与普通搜索的关键区别在于:Vault 理解语义,而不仅仅是关键词。即使查询中没有完全相同的词,它也能找到相关信息。
企业面临知识管理难题:
Vault 通过提供自托管 AI 驱动的知识检索解决这一问题。您的文档留在您的基础设施上。数据不会离开您的服务器。完全主权。
Vault 专为受监管和数据驻留敏感型组织设计:
如果您有敏感文档且无法将其发送到云端 AI 服务,Vault 就是为您准备的。
RAG = Retrieval-Augmented Generation(检索增强生成)。这是 Vault 背后的技术。
工作原理如下:
为什么这很重要:
主要区别:
| 方面 | ODW.ai Vault | ChatGPT / 云端 AI |
|---|---|---|
| 数据位置 | ✅ 自托管——保留在您的基础设施上 | ❌ 发送到 OpenAI/Anthropic 服务器 |
| 知识来源 | ✅ 您的文档(RAG) | ❌ 训练数据(可能已过时) |
| 准确性 | ✅ 基于您的文档,可引用 | ⚠️ 可能产生幻觉或过时 |
| 隐私 | ✅ 完全主权 | ❌ 数据发送到第三方 |
| 合规性 | ✅ 兼容 HIPAA、GDPR、SOC 2 | ❌ 可能无法满足监管要求 |
| 成本 | 免费(自托管)或 $99-$499/月 | $20-$200/用户/月 |
ChatGPT 是通用 AI 助手。Vault 是专为内部文档设计的知识检索系统。一般性问题用 ChatGPT;公司特定知识用 Vault。
Glean 和 Onyx 是优秀的云端 RAG 平台,但设计重点不同:
| 方面 | ODW.ai Vault | Glean / Onyx |
|---|---|---|
| 部署方式 | ✅ 自托管 | ❌ 云端 SaaS |
| 数据主权 | ✅ 完全控制 | ❌ 数据发送到供应商 |
| 开源 | ✅ 核心开源 | ❌ 专有 |
| 模型选择 | ✅ 模型无关(本地或 API) | ⚠️ 限于供应商模型 |
| 价格 | 免费(自托管)或 $99-$499/月 | $10-$30/用户/月 |
| 目标市场 | 受监管的中小企业 | 一般企业 |
如果您没有主权要求并需要托管服务,选择 Glean/Onyx。如果需要完全数据控制或自托管,选择 Vault。
是的。Vault 核心是开源的(Apache 2.0 许可证)。您可以:
企业层(SSO、高级 RBAC、审计日志、合规功能、高级支持)是付费的。这是我们资助开发的方式。
"主权"意味着完全控制您的数据:
这对受监管行业至关重要。如果您的 AI 工具将文档发送到云端供应商,就无法声称数据主权。
部署方面:需要。Vault 是自托管的,所以需要有人能够管理 Docker/Kubernetes、配置网络并监控基础设施。通常是 DevOps 工程师或 IT 顾问。
日常使用:不需要。管理控制台为非技术用户(知识管理员、合规官)设计。您可以在不编写代码的情况下上传文档、创建知识库并查询系统。
开发人员:Vault 提供 REST API 和 SDK(Python、JavaScript)用于自定义集成。开发人员可以构建自定义工作流、将 Vault 集成到内部工具等。
Vault 支持广泛的文档格式:
更多格式(PPTX、XLSX、电子邮件格式)计划在未来版本中支持。
Vault 分三步处理文档:
整个过程在您上传文档时自动发生。无需手动配置。
分块是将文档拆分为较小片段的过程。重要的原因:
Vault 提供三种分块策略:
向量嵌入是文本的数值表示。它们以 AI 能理解的方式捕捉文本的语义。
工作原理如下:
示例:
Vault 使用嵌入在您提问时查找相关文档块。您的问题被转换为嵌入,Vault 找到具有相似嵌入的文档块。
可以。Vault 支持批量上传:
对于大型文档集合(1,000+ 文件),我们建议使用连接器或 API。Web 界面最适合小型上传(10-100 个文件)。
可以。Vault 包含用于外部数据源的连接器框架:
连接器可以按计划同步(如每小时)或实时同步(通过 Webhook)。
会。Vault 支持增量更新:
这确保您的知识库始终保持最新,无需从头重新处理所有内容。
可以。Vault 支持多个知识库:
这对于多租户部署(如管理多个客户的 MSP)或有严格数据分离要求的组织很有用。
| 功能 | ODW.ai Vault | 典型替代方案 |
|---|---|---|
| 部署方式 | ✅ 自托管——完全主权 | ❌ 云端 SaaS——数据发送到供应商 |
| 开源 | ✅ 核心开源(Apache 2.0) | ❌ 专有或有限开源 |
| 模型选择 | ✅ 模型无关(本地或 API) | ⚠️ 限于特定模型 |
| 按任务模型路由 | ✅ 按查询切换模型 | ❌ 固定模型 |
| 价格 | 免费(自托管)或 $99-$499/月 | $10-$30/用户/月 |
| 套件集成 | ✅ 原生 ODW.ai 集成 | ❌ 需要自定义集成 |
| 企业功能 | ✅ SSO、RBAC、审计日志、合规 | ⚠️ 各异 |
Vault 在主权 + 模型灵活性方面具有竞争力。如果您需要完全数据控制并希望选择 AI 模型,Vault 是最佳选择。
PrivateGPT 和 Quivr 是开源 RAG 工具,但设计重点不同:
| 方面 | ODW.ai Vault | PrivateGPT / Quivr |
|---|---|---|
| 生产就绪 | ✅ 企业级 | ⚠️ 实验性 / 爱好者级 |
| 多租户 | ✅ 内置 | ❌ 仅单用户 |
| 访问控制 | ✅ RBAC、文档级权限 | ❌ 无或基础 |
| 审计日志 | ✅ 防篡改日志 | ❌ 无 |
| 模型路由 | ✅ 按任务模型选择 | ⚠️ 固定模型 |
| 支持 | ✅ 提供付费支持 | ❌ 仅社区 |
PrivateGPT/Quivr 适合实验,但不适合企业生产使用。Vault 专为需要可靠性、安全性和支持的受监管企业设计。
模型无关意味着 Vault 可与任何 AI 模型配合使用——您不会被锁定在特定供应商。
Vault 支持:
您甚至可以按查询切换模型——简单问题用本地模型(快速、主权),复杂问题用 API 模型(更强大)。
可以。Vault 支持完全离线部署:
这对互联网访问受限或被禁止的政府、军事和高安全环境至关重要。
Vault 的检索准确率取决于几个因素:
目标:基准语料库上≥85% MRR@10(前 10 个结果的平均倒数排名)。这意味着正确答案在 85% 的情况下出现在前 10 个结果中。
可以。Vault 提供可配置的检索策略:
对于开发人员:Vault 的检索管道是模块化的——您可以使用 SDK 编写自定义检索逻辑。
支持。Vault 支持多语言文档:
UI 目前仅支持英语(v1),但多语言 UI 计划在 v1.1 中推出。
可以。Vault 核心是开源的(Apache 2.0 许可证):
这对注重主权的组织至关重要。您应该能够验证 AI 工具在做什么。
Vault 提供多种查询方式:
查询示例:
Vault 检索相关文档块并使用 AI 生成简洁答案。您还可以查看源文档以进行验证。
可以。Vault 提供来源引用:
这使您能够验证答案并追溯到原始文档——对准确性和可审计性至关重要的受监管行业来说至关重要。
如果 Vault 找不到相关文档,它会说"我不知道",而不是编造答案。
这是 RAG 的一个关键特性——AI 基于您的文档。如果信息不在您的知识库中,Vault 不会产生幻觉。
您还可以配置 Vault 以:
可以。Vault 支持对话式查询:
这使 Vault 感觉像与知识渊博的同事对话,而不仅仅是搜索引擎。
可以。Vault 支持元数据过滤:
这对于您想要缩小搜索范围的大型知识库很有用。
查询速度取决于您的配置:
| 组件 | 本地(本地部署) | 基于 API(OpenAI 等) |
|---|---|---|
| 检索 | 100-500 毫秒 | 100-500 毫秒 |
| 生成 | 1-5 秒(取决于 GPU) | 1-3 秒(取决于模型) |
| 总计 | 1-6 秒 | 1-4 秒 |
对于延迟敏感的应用,我们建议:
可以。Vault 支持查询结果导出:
这对于生成报告、与同事共享答案或出于合规目的归档查询结果很有用。
可以。Vault 提供查询分析(企业版):
这帮助您了解 Vault 的使用情况以及改进知识库的方向。
安全。Vault 采用安全最佳实践构建:
Vault 专为受监管行业设计。如果您可以使用 Vault,就能通过合规审计。
不能。Vault 在您的基础设施上自托管。ODW.ai 完全无法访问您的文档、查询或嵌入。
与云端 RAG 平台(Glean、Onyx)不同,Vault 不会将遥测数据发送到第三方。一切都留在您的服务器上。
这对注重主权的组织至关重要。如果您的 RAG 工具将文档发送到云端供应商,就无法声称数据主权。
可以。Vault 提供细粒度访问控制(企业版):
访问控制在查询时执行——如果用户没有权限访问某文档,Vault 不会在查询结果中返回它。
支持。Vault 通过 SAML 2.0 和 OIDC 支持SSO(单点登录)(企业版):
SSO 允许用户使用现有的企业凭据登录 Vault——无需记住单独的用户名/密码。
是的。Vault HIPAA 兼容:
Vault 帮助您满足 HIPAA 要求的技术保障。您仍需要单独解决管理和物理保障。
是的。Vault GDPR 兼容:
Vault 帮助您满足 GDPR 要求的技术和组织措施(第 32 条)。您仍需要单独解决法律和程序要求。
可以。Vault 支持物理隔离(气隙)部署(无互联网访问):
物理隔离(气隙)部署常见于政府承包商、军事和高安全环境。
Vault 在查询时执行访问控制:
示例:初级员工查询"显示高管薪酬"。如果他们无权访问"高管薪酬"文档,Vault 不返回结果——并且查询会被记录以供审计。
Vault 是模型无关的——它支持广泛的模型:
嵌入模型:
生成模型:
您可以随时切换模型——无需更改代码。
可以。Vault 支持本地模型,通过:
本地模型在您的硬件上运行——数据不会离开您的基础设施。完全主权。
可以。Vault 支持基于 API 的模型:
基于 API 的模型在您需要本地模型尚无法匹敌的前沿能力(如复杂推理、长上下文窗口)时很有用。
可以。Vault 支持按任务模型路由:
这为您提供了两全其美的方案:敏感查询的主权,复杂查询的能力。
选择嵌入模型取决于您的优先事项:
| 模型 | 速度 | 准确性 | 成本 | 主权 |
|---|---|---|---|---|
| sentence-transformers/all-MiniLM-L6-v2 | ✅ 快速 | ⚠️ 良好 | ✅ 免费(本地) | ✅ 完全 |
| sentence-transformers/all-mpnet-base-v2 | ⚠️ 中等 | ✅ 更好 | ✅ 免费(本地) | ✅ 完全 |
| OpenAI text-embedding-3-large | ✅ 快速 | ✅ 最佳 | ❌ 付费 | ❌ 无 |
| Cohere embed-v3 | ✅ 快速 | ✅ 最佳 | ❌ 付费 | ❌ 无 |
建议:
选择生成模型取决于您的优先事项:
| 模型 | 速度 | 质量 | 成本 | 主权 |
|---|---|---|---|---|
| Llama 3 8B(本地) | ✅ 快速 | ⚠️ 良好 | ✅ 免费 | ✅ 完全 |
| Llama 3 70B(本地) | ⚠️ 慢 | ✅ 更好 | ✅ 免费 | ✅ 完全 |
| GPT-4o-mini(API) | ✅ 快速 | ✅ 良好 | ❌ 付费 | ❌ 无 |
| GPT-4o(API) | ⚠️ 中等 | ✅ 最佳 | ❌ 付费 | ❌ 无 |
| Claude 3.5 Sonnet(API) | ⚠️ 中等 | ✅ 最佳 | ❌ 付费 | ❌ 无 |
建议:
Vault v1 不支持。Vault 使用现有模型——不支持微调。
但是,您可以:
微调支持计划在 v2.0(2027 年第二季度)中推出。
可以。Vault 是模型无关的——您可以随时切换模型:
这使您的投资面向未来——当更好的模型发布时,您可以立即采用,无需重新设计系统。
Vault 提供三种部署选项:
docker-compose up)即可运行。最适合开发和小型部署。对于大多数客户,Docker Compose 是最快的路径。对于生产环境,我们建议 Kubernetes。
配置时间取决于您的部署:
docker-compose up。目标:从下载到首次查询 <4 小时(对于 Docker Compose 部署)。
部署方面:需要。Vault 是自托管的,所以需要有人能够管理 Docker/Kubernetes、配置网络并监控基础设施。通常是 DevOps 工程师或 IT 顾问。
日常使用:不需要。管理控制台为非技术用户(知识管理员、合规官)设计。您可以在不编写代码的情况下上传文档、创建知识库并查询系统。
开发人员:Vault 提供 REST API 和 SDK(Python、JavaScript)用于自定义集成。开发人员可以构建自定义工作流、将 Vault 集成到内部工具等。
Vault 的要求取决于您的部署:
| 组件 | 最低要求 | 推荐配置 |
|---|---|---|
| CPU | 2 核 | 4+ 核 |
| 内存 | 8 GB | 16+ GB |
| 存储 | 50 GB SSD | 200+ GB SSD(取决于文档量) |
| GPU(用于本地模型) | 无(使用 API 模型) | NVIDIA A100 或同等产品(用于本地模型) |
| 操作系统 | Linux(Ubuntu 20.04+、RHEL 8+) | Ubuntu 22.04 LTS |
如果使用基于 API 的模型(OpenAI、Anthropic),不需要 GPU。如果使用本地模型,强烈建议使用 GPU。
可以。Vault 可以部署在任何云提供商上:
我们为每个云提供商提供部署指南。对于生产环境,我们建议 Kubernetes 配合托管数据库(RDS、Cloud SQL、Azure SQL)。
可以。Vault 提供迁移工具:
迁移通常需要 1-2 周。我们为常见平台(Glean、Onyx、PrivateGPT)提供迁移指南和支持。
Vault 通过管理控制台(基于 Web 的 UI)或环境变量配置:
大多数配置通过 UI 完成。对于高级用户,Vault 还支持通过 YAML 文件或环境变量配置。
可以。Vault 包含沙盒模式:
我们建议在部署到生产环境前花 1-2 天在沙盒模式下测试。
Vault 定价基于部署模式和功能:
| 版本 | 价格 | 包含 |
|---|---|---|
| 社区(免费) | $0 | 自托管、核心功能、社区支持 |
| 专业版 | $99/月 | 自托管、所有核心功能、邮件支持 |
| 企业版 | $299-$499/月 | 自托管、企业功能(SSO、RBAC、审计日志)、优先支持 |
| 托管版 | 自定义定价 | ODW.ai 为您托管和管理 Vault(私有云) |
额外成本:
是的,显著更便宜。Glean 和 Onyx 通常成本为 $10-$30/用户/月。对于 100 人的公司,那就是 $1,000-$3,000/月。
Vault 成本为 $0-$499/月(固定费率,非按用户)。对于 100 人的公司,Vault 便宜 2-30 倍。
而且 Vault 是自托管的——您获得完全主权。Glean/Onyx 是云端 SaaS——您将文档发送给他们。
当然,Glean/Onyx 是托管服务(无需管理基础设施),而 Vault 需要自托管。但如果您有基础设施且需要主权,Vault 在成本上是明显的赢家。
没有隐藏成本。总拥有成本包括:
仅此而已。没有设置费、没有意外收费、没有按用户收费。
是的。社区版 100% 免费:
唯一的限制:
我们相信开源。如果不需要企业功能,您可以永久免费使用 Vault。
我们接受:
年度订阅提供发票。详情请联系我们。
可以。我们提供30 天退款保证。如果在最初 30 天内不满意,请联系我们获得全额退款——无需解释原因。
30 天后,您可以随时取消。您将继续拥有访问权限直到计费周期结束,但部分月份不提供退款。
是的。Vault 是 ODW.ai 套件的一部分。您可以:
套件包中 Vault 享有 20-30% 的折扣。而且所有模块原生集成——Vault 作为 Desk、Voice 和其他模块的知识后端。
Vault 水平扩展:
对于超大型部署(100 万+ 文档),我们建议:
Vault 支持无限用户(无按用户限制):
Vault 水平扩展——添加更多节点以处理更多并发用户。典型部署每节点支持 100-1,000 个并发用户。
如果 Vault 宕机,查询功能不可用,但您的文档是安全的:
对于高可用性部署,我们建议:
Vault 包含监控仪表板:
您还可以通过标准协议将指标导出到外部监控工具(Prometheus、Grafana、Datadog)。
Vault 数据存储在两个地方:
我们建议:
可以。Vault 支持多租户:
这对于有严格数据分离要求的组织或多租户部署(如管理多个客户的 MSP)很有用。
Vault 旨在直观易用,但我们提供培训资源:
大多数团队在 1-2 小时的培训后即可高效工作。Web 界面特别直观——最终用户无需技术技能。
Vault 与所有 ODW.ai 产品原生集成:
如果使用 ODW.ai 套件,Vault 集成是自动的——无需单独配置。
提供。Vault 提供用于编程访问的 REST API:
API 有完整文档(OpenAPI/Swagger),支持通过 API 密钥或 OAuth 2.0 进行身份验证。
提供。Vault 为流行语言提供 SDK:
pip install odw-vaultnpm install @odw/vaultSDK 封装 REST API,为开发人员提供更便捷的接口:
from odw_vault import VaultClient
client = VaultClient(api_key="your-api-key")
results = client.query("What's our refund policy?", knowledge_base="hr-policies")
print(results.answer)
SDK 是开源的,可在 GitHub 上获取。
可以。Vault 可以通过以下方式与内部工具集成:
常见集成:
可以。Vault 包含用于外部数据源的连接器框架:
连接器可以按计划同步(如每小时)或实时同步(通过 Webhook)。
可以。Vault 提供可嵌入的查询小部件:
这适用于:
可以。Vault 可以与现有 AI 工具一起使用:
Vault 旨在成为知识层——它提供检索,您可以使用任何 AI 工具进行生成。
Vault 功能强大,但在 v1.0 中有以下限制:
会。我们将在 v1.1(2026 年第四季度)中添加对更多文档格式的支持:
如果您需要特定格式,请告诉我们——我们根据客户需求确定优先级。
计划在 v1.2(2027 年第一季度)。语音/音频导入将包括:
这是希望搜索会议录音和语音备忘录的客户的高优先级功能。
计划在 v1.1(2026 年第四季度)。多语言 UI 将包括:
查询引擎已经支持多语言文档和查询——v1 中只有 UI 仅支持英语。
关键里程碑:
路线图可能会根据客户反馈更改。请联系我们获取最新路线图或请求功能。
Vault 不适合以下情况:
不保证。没有 AI 系统能保证 100% 准确。Vault 的准确性取决于:
目标:≥85% MRR@10(前 10 个结果的平均倒数排名)。这意味着正确答案在 85% 的情况下出现在前 10 个结果中。
Vault 提供来源引用,以便您可以验证答案。如果准确性差,请尝试提高文档质量、切换到更好的模型或改写查询。
三条路径:
odw.ai/vault 下载 Vault 或预约演示。