快速入门
本指南帮助你在 5 分钟内完成:登录(可选)、搜索模型、运行并对话、管理模型、以及启动 API 服务。
前提条件
确保已完成 csghub-lite 命令行工具和推理后端的安装。详见 安装指南。
第一步:登录(可选)
如果您需要访问存放在传神社区(CSGHub)上的私有模型,可以先在终端中配置您的 Access Token 进行登录:
csghub-lite login
按终端提示输入您在 hub.opencsg.com 上的 Access Token。对于公开模型,您可以跳过此步骤。
第二步:搜索模型
您可以在终端中直接搜索传神社区上的模型:
csghub-lite search "Qwen3"
输出示例:
Found 34 models (showing top 34):
NAME DOWNLOADS LICENSE DESCRIPTION
Qwen/Qwen3-0.6B-GGUF 40 apache-2.0 Qwen3-0.6B-GGUF...
Qwen/Qwen3-0.6B 289229 apache-2.0 ...
...
提示:本地直接推理通常需要 GGUF 格式的模型,建议搜索时加上
"GGUF"关键字。如果是 SafeTensors 格式,CSGLite 将在首次运行时自动调用系统 Python 转换为 GGUF。
第三步:运行并对话
使用 run 命令可以自动下载模型(如果本地不存在)、启动后台推理引擎并直接进入交互式聊天界面:
csghub-lite run Qwen/Qwen3-0.6B-GGUF
首次运行时会展示下载进度(约 610MB),下载完成后自动加载并开始聊天:
Loading Qwen/Qwen3-0.6B-GGUF...
Model Qwen/Qwen3-0.6B-GGUF ready. Type '/bye' to exit, '/clear' to reset context.
>>> 你好,介绍一下自己
我是AI助手,专注于帮助用户解决问题和获取信息。
>>> /bye
Goodbye!
第四步:管理本地模型
# 查看本地已下载的模型
csghub-lite list
# 查看指定模型的详细元信息
csghub-lite show Qwen/Qwen3-0.6B-GGUF
# 删除指定的本地模型,释放磁盘空间
csghub-lite rm Qwen/Qwen3-0.6B-GGUF
第五步:手动启动 API 服务
除了随 run/chat 自动拉起外,您也可以使用以下命令独立启动 API 服务,为第三方客户端或开发程序提供大模型接口:
csghub-lite serve
服务默认监听 localhost:11435。您可以使用命令行测试接口的可用性:
# 1. 服务健康检查
curl http://localhost:11435/api/health
# 2. 执行大模型对话补全
curl http://localhost:11435/api/chat -d '{
"model": "Qwen/Qwen3-0.6B-GGUF",
"messages": [{"role": "user", "content": "Hello!"}]
}'
# 3. 查看内存中正在运行的模型
curl http://localhost:11435/api/ps
下一步
- CLI 命令参考 — 查看所有命令的详细参数和进阶选项
- REST API 参考 — 了解如何与 Ollama/OpenAI 兼容的 API 进行集成
- 配置说明 — 配置本地存储路径或切换私有部署环境