Hedy 是一款私有化部署的 AI 员工。它在您运行的地方运行——试点用一台跑 Docker Compose 的 VM,高可用用 Kubernetes 上的 Helm,或用本地模型完全气隙部署。试点约 30 分钟即可就绪。这里没有任何云端注册;整套栈都落在您的边界之内。
| 最适合 | 如何 | 高可用 | |
|---|---|---|---|
| Docker Compose | 试点 / 单团队 | 在一台 VM 上 docker compose up -d | 单节点 |
| Kubernetes (Helm) | 生产 / 规模化 | 将 Helm chart 部署到您的集群 | 多副本,StatefulSet |
| 气隙 | 无互联网网络 | Compose/Helm + 本地 vLLM 或 Ollama;离线 Ed25519 许可证 | 皆可 |
| 托管网关 | 零模型配置 | 将模型调用路由到 Hedy 的网关;其余一切仍归您所有 | 皆可 |
自部署 / BYO 是旗舰方案——您的密钥、您的模型、零数据次级处理方。托管以此换取零配置的速度,并改变数据驻留的事实;参见安全模型。
您 VPC 中的一台 Linux VM(试点在约 2 vCPU / 8 GB 上即可从容运行;更重的检索需相应扩容)。Docker + Compose,或用于 Helm 的 Kubernetes 集群。
一个飞书或 Lark 应用(一等支持),或 Slack。这是 AI 员工驻留并作答的地方。
您自己的 API 密钥——Anthropic 或 OpenAI 兼容,或 DeepSeek、Qwen、Kimi、GLM 等国产供应商——或用于气隙的本地 vLLM / Ollama 端点。或采用托管模式,跳过这一步。
将 Hedy 指向 wiki、Git、Notion 或 Confluence。首日可选;在配置好 embeddings 之前,检索回退到全文检索。
离线校验——不回连。首次启动前放入即可(对气隙友好)。
拉取固定的 semver 镜像(绝不用 latest)并放置您的 licence.json。仓库只提供 .env.example——机密通过注入提供,绝不提交。
.env设置您的渠道凭据、模型密钥(或指向本地 vLLM/Ollama),以及一个强内部令牌。将发布的端口绑定到您反向代理之后的 127.0.0.1。
docker compose up -dPostgres、Redis、控制面、LLM 网关与 agent 相继启动。健康检查把关就绪状态。
将应用添加到您的飞书/Lark 或 Slack 工作区;AI 员工会自我介绍并运行自检。
添加一个源,提出一个问题——答案会带引用返回,并限定在提问者可见的范围内。几分钟内产出首个交付物。
发布的端口绑定到 127.0.0.1;您的反向代理终结 TLS。Docker 端口发布会绕过主机防火墙——绑定回环地址才是可靠的边界。
凭据通过部署环境注入进入。仓库只提供一个示例文件;agent 被硬性规定绝不将凭据值存入记忆、文件或日志。
每一次模型调用都经由唯一的网关,该网关掌管配额、成本核算与降级策略——因此花费可按团队与项目度量,且无任何调用能绕过它。
每个动作都连同执行者、对象与推理一并记录——无论对 agent 还是对管理员,都没有更新或删除的路径。
.env、docker compose up -d、接入一个渠道、指向一个知识源。生产环境的 Helm 部署接入您的集群与 IdP 需要更长时间。.env.example;agent 被硬性规定绝不将凭据值写入记忆、文件或日志,模型密钥仅在网关之后的服务端使用。