跳到主要内容

接入与调用模型

开发者调用已开通的模型;平台管理员负责配置模型来源、上游凭据和服务状态。本文将这两类任务分别说明。首次调用示例见快速开始。

查询可用模型​

调用模型前,可通过 GET /v1/models 查询可用模型列表。传神社区的接口地址为 https://ai.space.opencsg.com/v1/models。

在运行环境中设置网关凭据 CSGHUB_API_KEY 后,执行:

curl --request GET 'https://ai.space.opencsg.com/v1/models' \
--header "Authorization: Bearer ${CSGHUB_API_KEY}"

从返回列表中选择模型标识,填写到后续调用的 model 参数中。自部署环境请将域名替换为实际网关地址,保留 /v1/models 路径。各模型支持的接口与参数,请结合模型服务说明查看。

选择服务来源​

来源接入方式相关操作
公共推理管理员从资产管理的模型详情页创建,启动后在 AI 网关的公共推理列表管理公共推理管理、调用公共推理
专属实例用户从模型页面创建实例,查看实例 API 地址与调用示例创建专属实例、使用专属实例
商业 API管理员在 AI 网关的商业 API 中配置模型名称、Endpoint 和供应商凭据商业 API 管理

这些管理操作和来源的可用范围取决于部署版本与权限。公共推理需先从模型详情页创建并启动,随后在网关的公共推理列表中管理。

接入第三方商业 API​

  1. 进入管理员后台的 AI 网关 → 商业 API。
  2. 新建服务,填写对外使用的模型名称和相关模型信息。
  3. 添加上游 Endpoint URL 与对应供应商凭据;多个上游需提供相同的目标模型能力。
  4. 设置模型能力、启用状态及需要的内容检测选项。
  5. 保存后检查可用状态,使用服务的调用地址和模型名称验证一次请求。

需要多上游时,继续配置路由策略。应用使用平台发放的网关 Key;供应商凭据由管理员配置在上游,不交给各应用分别维护。

调用端点​

下表列出网关提供的接口类型。实际可用端点、参数与模态由部署、上游和模型决定;代理路径中的占位符必须使用已注册的资源标识。

能力端点说明
模型列表/v1/models通过 GET 请求查询可用模型
文本生成/v1/chat/completions支持流式与非流式调用
响应生成/v1/responses支持 OpenAI Responses API 协议调用
文本向量化/v1/embeddings将文本转换为向量表示(Embedding)
文本重排序/v1/rerank重排序(Rerank)扩展接口,不属于 OpenAI 标准端点
Anthropic 消息/v1/messagesAnthropic 协议代理,使用该服务的认证及请求说明
图像生成/v1/images/generations模型支持的图像生成任务
语音转文字/v1/audio/transcriptions音频转录
视频生成/v1/videos模型支持的视频生成任务
MCP 代理/v1/mcp/*MCP 服务转发
Agent 代理/v1/agent/:type/*Agent 服务代理
沙盒代理/v1/sandboxes/:name/*已部署沙盒服务的代理入口

接入 SDK 与处理模型差异​

OpenAI 兼容的文本接口可使用 OpenAI SDK,通过修改 base_url 和 api_key 接入,示例见快速开始。专属实例也提供 Python、JavaScript 和 cURL 调用示例。

  • 以服务页面的模型名称和 API 地址为准;不要将上游供应商地址与网关地址混用。
  • 流式输出、工具调用、结构化输出和多模态参数需要所选模型与接口共同支持。
  • 同一套客户端可以访问多个服务,但模型间的参数、上下文长度和输出能力可能不同。
  • 模型文件的版本管理与运行中服务的版本不是同一件事,切换上游后应重新验证应用调用。

相关文档​

身份与访问权限 · 路由与调用稳定性 · MCP 与 Agent 接入