跳到主要内容

团队管理与运维

团队使用 AI Gateway 时,需要把模型接入、应用凭据、费用归属和生产维护职责连接起来。本页提供基于现有平台能力的操作组织建议。

明确职责​

角色主要任务
平台管理员接入上游、配置服务、路由和检测,观察平台运行状态
组织管理员管理成员及组织调用凭据,核对组织消费
应用负责人使用正确的 Key 和模型名称,处理请求失败与凭据更换
运维人员检查服务、实例及依赖组件,执行部署维护流程

角色的实际权限以部署配置为准。组织成员操作参见组织管理,企业登录集成参见自定义用户系统。

接入一个团队​

  1. 确认团队将使用哪些模型、采用个人还是组织费用归属。
  2. 由管理员完成模型接入,检查服务及上游可用性。
  3. 为应用创建可识别的API Key,配置额度与有效期。
  4. 按快速开始完成最小调用,核对用量和身份。
  5. 明确凭据维护、异常处理和消费查询的负责人。

建议为开发与生产应用分别创建 Key,并设置便于识别的名称、消费额度和有效期。需要独立网络或计算资源时,按环境分别配置部署资源。

维护配置​

变更模型上游、路由或内容检测前,保存当前配置,并先在测试服务验证。变更后检查调用结果、成功率、延迟和费用;出现异常时,根据保存的配置恢复服务。

更新专属实例的资源、运行时或副本等配置,应遵循实例设置说明;需要暂停的变更应安排维护时间。

部署升级与支持​

安装、TLS 和运行配置参见Kubernetes 配置,升级与恢复按升级指南执行。部署版本的回滚与网关单项策略的回退是不同操作。

生产问题先按排障指南区分客户端、网关和上游;商业支持渠道、响应时间和维护安排按所采购的服务约定执行。