通过本平台一键将 GPT OSS 20B 部署到你的 Jetson 设备。
| 设备 | 用途 |
|---|---|
| NVIDIA Jetson(reComputer) | 在 Docker 中运行 GPT OSS 20B |
通过本平台一键将 GPT OSS 20B 部署到你的 Jetson 设备。
| 设备 | 用途 |
|---|---|
| NVIDIA Jetson(reComputer) | 在 Docker 中运行 GPT OSS 20B |
将容器化的 GPT OSS 20B 运行时通过 SSH 部署到你的 Jetson。
通过 SSH 一键部署到 Jetson。
20llama-server 的 GPU 层数参数 (-ngl)
1024llama-server 的上下文窗口参数 (-c)
| 问题 | 解决方法 |
|---|---|
| SSH 连接失败 | 检查 Jetson IP、用户名、密码以及 SSH 服务状态 |
| Docker 运行时检查失败 | 确认已安装 Docker 且具备 NVIDIA runtime |
| 找不到 Docker Compose | 确认已安装 docker compose 或 docker-compose |
| 服务启动失败 | 登录 Jetson 看日志:docker compose logs --tail=200 |
/v1/models 返回 503 {"message":"Loading model"} | 模型正在预热,首次加载可能需要几分钟 |
| 启动时内存不足 | 降低参数,例如 Llama NGL=16、Llama Context=512 |
llama-serverhttp://<jetson-ip>:8080http://<jetson-ip>:8080/v1/models在此步骤直接在浏览器新标签页中打开 Jetson 上的服务地址。
http://<jetson-ip>:8080| 问题 | 解决方法 |
|---|---|
| 主机输入无效 | 填入有效的 IP 或主机名,例如 192.168.1.100 |
| 没有打开新标签页 | 允许本站点的弹出窗口后重试 |
| 服务页面打不开 | 确认 Jetson 服务监听在 8080,并且网络可达 |
GPT OSS 20B 运行时已成功部署到你的 Jetson。
http://<jetson-ip>:8080