快速开始
从一台裸机 GPU 服务器到第一个可调用的推理端点,全程只需要几条命令。这一节把完整链路走一遍:安装控制面、引导节点、部署模型、发起调用。
本节内容
01
安装与初始化
一行安装脚本拉起控制面,检查系统依赖与端口要求。
02
引导第一个 GPU 节点
在节点上执行引导脚本,等待拓扑自动注册与就绪检查。
03
部署第一个模型
选择模型源、完成预检并启动推理服务。
04
发起第一次调用
创建 API Key,绑定端点,用 OpenAI 兼容格式发起推理请求。
从一台裸机 GPU 服务器到第一个可调用的推理端点,全程只需要几条命令。这一节把完整链路走一遍:安装控制面、引导节点、部署模型、发起调用。
一行安装脚本拉起控制面,检查系统依赖与端口要求。
在节点上执行引导脚本,等待拓扑自动注册与就绪检查。
选择模型源、完成预检并启动推理服务。
创建 API Key,绑定端点,用 OpenAI 兼容格式发起推理请求。