企业私有化方案 · AI Gateway
将统一模型网关部署在企业自己的基础设施中,统一管理模型路由、密钥、用量、审计和安全策略。
AI Gateway 是无界模型云的企业私有化部署版本。业务系统只访问企业内部的网关地址,管理员在同一个后台管理组织、gk_ API Key、模型供应商、用量和审计。
AI Gateway 私有化部署指南
Docker Compose、内网镜像、首次登录、升级、备份与排障。
对话 API
使用 OpenAI 兼容的 /v1/chat/completions 接口接入业务系统。
模型与能力
查看可用能力、模型接入方式和调用约束。
私有化部署适合需要数据留在企业网络、统一治理多模型调用或接入自托管推理服务的团队。涉及高可用、多区域或 GPU 推理集群时,请在部署前完成容量和网络规划。
为什么部署在企业内部
- 数据边界可控:网关配置、API Key、调用记录和审计数据保留在企业网络内;请求内容是否发送到外部上游由企业启用的模型供应商决定。
- 统一模型入口:应用只维护一个 Base URL 和一套网关 Key,模型供应商可以在后台调整。
- 集中治理:路由、限流、配额、用量、审计和安全审核在一个控制面配置。
- 平滑迁移:数据面保持 OpenAI 兼容,已有应用通常只需切换 Base URL、Key 和模型配置。
能力范围
AI Gateway 提供统一的对话、图像、语音识别、语音合成、OCR 和视觉分割接入。实际可调用的模型取决于私有化实例中启用的供应商和模型。
| 能力 | 企业侧用途 |
|---|---|
| 模型路由 | 在多家上游模型、自托管服务和不同模型版本之间统一调度。 |
| API Key 与组织 | 为每个应用或团队签发独立的 gk_ Key,便于授权、限额和停用。 |
| 用量与审计 | 按模型、能力、调用和计费项记录使用情况,支持对账和排障。 |
| 安全策略 | 输入、输出审核与 PII 脱敏独立配置,可在后台按组织维护。 |
| 可观测性 | 通过 Grafana 查看网关、用量采集和基础运行指标。 |
交付方式
客户部署使用已经发布的 public 多架构镜像,或使用企业内网 registry 中完整镜像镜像组。交付包中的 ai-gateway/onprem/ 包含 Docker Compose、.env.example、Vector 与 Grafana 配置;部署参数以这些文件为准。
详细的环境变量、镜像清单、启动顺序、升级和恢复步骤见 AI Gateway 私有化部署指南。
接入建议
- API Key 只放在服务端或企业密钥管理系统中,不暴露到浏览器和客户端。
- 每个业务系统使用独立的
gk_Key,便于单独审计、限流和撤销。 - 将网关 Base URL、模型 ID 和 Key 名称作为应用配置项,而不是写死在业务代码中。
- 生产实例应置于企业 HTTPS 反向代理之后,数据库、Redis、GreptimeDB 和内部用量接口不对外暴露。
需要架构规划或部署支持时,可 联系部署支持。