LLMPodLLMPod

快速开始

从一台裸机 GPU 服务器到第一个可调用的推理端点,全程只需要几条命令。这一节把完整链路走一遍:安装控制面、引导节点、部署模型、发起调用。

本节内容

01

安装与初始化

一行安装脚本拉起控制面,检查系统依赖与端口要求。

02

引导第一个 GPU 节点

在节点上执行引导脚本,等待拓扑自动注册与就绪检查。

03

部署第一个模型

选择模型源、完成预检并启动推理服务。

04

发起第一次调用

创建 API Key,绑定端点,用 OpenAI 兼容格式发起推理请求。

没找到想要的

在社区论坛提问,或直接联系支持团队,多数问题在一个工作日内有回复。