受监管行业、主权云,或纯粹出于审慎:Hedy 可配合本地模型完全气隙运行。同样的技能、同样的治理——零外部调用。许可通过 Ed25519 签名离线校验。
Hedy 可完全气隙运行:把它指向本地模型服务(vLLM 或 Ollama),任何请求都不会离开您的网络。知识、记忆与审计日志都存放在您自己的 Postgres 中。许可采用 Ed25519 签名离线校验,因此没有许可回调、没有数据次级处理方(sub-processors)、没有回传。您得到同一名 AI 员工与同样的治理(只增不改审计、L0/L1/L2 审批、默认拒绝的写操作、按提问者 ACL 的检索),且零出网流量。
最后更新:2026 年 7 月 20 日
把网关指向边界内的 vLLM 或 Ollama。兼容 Anthropic 与 OpenAI 的 API——包括 DeepSeek、Qwen、Kimi、GLM 等国内厂商——工作方式完全一致。
知识库、嵌入向量、记忆、审计与计量全部存放在您的 PostgreSQL 中。运行时没有任何外部依赖。
审批分级、白名单、行为测试与审计台账在离线环境下工作方式完全一致。
绑定地址配置与不存在外部端点这两点,在 compose 文件本身即可审计。
气隙是一种部署模式,不是功能阉割档位。Hedy 采用自带模型 key 的方式,而「您的 key」可以指向子网内的本地 vLLM 或 Ollama 端点。所有 LLM 调用都经 Hedy 的 LLM 代理路由,它是计量与配额的唯一卡点。当模型在本地时,该代理只与您的推理服务器通信。不存在对任何托管模型 API 的出站调用,也不存在提示词、文档或记忆离开边界的路径。
您的数据留在您能亲自检查的地方。检索到的知识、这名员工的长期记忆、用量计数器与审计轨迹全部写入您的 Postgres。没有任何东西存放在厂商云里,因为链路中根本没有厂商云,也没有数据次级处理方(sub-processors)。这是与住在 Slack 或 Teams 里的云端 AI 同事的核心区别:那些产品必须把您的上下文搬到别人的基础设施上才能工作。Hedy 是运行在您的基础设施上的一名 AI 员工,产出一支团队的工作量,而不外传一个字节。
许可同样离线工作。授权信息承载于一份 Ed25519 签名的许可文件中,Hedy 用公钥在本地校验。没有激活服务器,没有周期性联网签到,也没有依赖联网才能生效的远程停用开关。您可以把它部署进一个完全没有出网路由的网络,产品照常启动、校验、运行。约 30 分钟的 Docker Compose 安装,就能从零得到一名可用的气隙 AI 员工。
气隙模式下的治理与联网时完全一致,因为治理是代码与配置,不是托管服务。审计日志只增不改,没有更新或删除 API。写操作默认拒绝、须经白名单开通,并由 L0/L1/L2 审批分级把关。检索按提问者的 ACL 限定范围,回答绝不会呈现提问者无权查看的文档。证据门依然强制回答逐字引用来源。剪断网线消除了出网风险,却没有放松任何一项控制。