TensorFusion Docs

企业私有化方案 · AI Gateway

将统一模型网关部署在企业自己的基础设施中,统一管理模型路由、密钥、用量、审计和安全策略。

AI Gateway 是无界模型云的企业私有化部署版本。业务系统只访问企业内部的网关地址,管理员在同一个后台管理组织、gk_ API Key、模型供应商、用量和审计。

私有化部署适合需要数据留在企业网络、统一治理多模型调用或接入自托管推理服务的团队。涉及高可用、多区域或 GPU 推理集群时,请在部署前完成容量和网络规划。

为什么部署在企业内部

  • 数据边界可控:网关配置、API Key、调用记录和审计数据保留在企业网络内;请求内容是否发送到外部上游由企业启用的模型供应商决定。
  • 统一模型入口:应用只维护一个 Base URL 和一套网关 Key,模型供应商可以在后台调整。
  • 集中治理:路由、限流、配额、用量、审计和安全审核在一个控制面配置。
  • 平滑迁移:数据面保持 OpenAI 兼容,已有应用通常只需切换 Base URL、Key 和模型配置。

能力范围

AI Gateway 提供统一的对话、图像、语音识别、语音合成、OCR 和视觉分割接入。实际可调用的模型取决于私有化实例中启用的供应商和模型。

能力企业侧用途
模型路由在多家上游模型、自托管服务和不同模型版本之间统一调度。
API Key 与组织为每个应用或团队签发独立的 gk_ Key,便于授权、限额和停用。
用量与审计按模型、能力、调用和计费项记录使用情况,支持对账和排障。
安全策略输入、输出审核与 PII 脱敏独立配置,可在后台按组织维护。
可观测性通过 Grafana 查看网关、用量采集和基础运行指标。

交付方式

客户部署使用已经发布的 public 多架构镜像,或使用企业内网 registry 中完整镜像镜像组。交付包中的 ai-gateway/onprem/ 包含 Docker Compose、.env.example、Vector 与 Grafana 配置;部署参数以这些文件为准。

详细的环境变量、镜像清单、启动顺序、升级和恢复步骤见 AI Gateway 私有化部署指南

接入建议

  • API Key 只放在服务端或企业密钥管理系统中,不暴露到浏览器和客户端。
  • 每个业务系统使用独立的 gk_ Key,便于单独审计、限流和撤销。
  • 将网关 Base URL、模型 ID 和 Key 名称作为应用配置项,而不是写死在业务代码中。
  • 生产实例应置于企业 HTTPS 反向代理之后,数据库、Redis、GreptimeDB 和内部用量接口不对外暴露。

需要架构规划或部署支持时,可 联系部署支持

目录