# 【compshare】UCloud优刻得GPU租用平台推荐

> 作者/来源: UCloud 运营管理员
> 发布时间: 2024-06-05T09:34:00.000Z
> 分类: GPU
> 标签: 云主机, AI, GPU
> 原文链接: http://117.50.162.249:3000/yun/articles/82

---

# 【compshare】UCloud优刻得GPU租用平台推荐

> 来源: https://www.ucloud.cn/yun/131108.html
> 作者: UCloud小助手
> 发布日期: 发布于2024-06-05 17:34

【compshare】推荐一个GPU按小时租的平台，使用实体机部署，可以方便快速的部署xinf推理框架并提供web展示，部署qwen大模型，特别方便

UCloud(优刻得)是中国知名的中立云计算服务商，科创板上市(股票代码：688158)，中国云计算第一股，专注于提供可靠的企业级云服务，包括云服务器、云主机、云数据库、混合云、CDN、人工智能等服务。

compshare算力共享平台：

专注于提供高性价比算力资源，海量GPU，一键部署，即算即用，让AI训练、深度学习、科研计算效率翻倍。

————————————————                        

原文链接：https://blog.csdn.net/freewebsys/article/details/139188230

![image.png](https://ucloud-blog.cn-bj.ufileos.com/articles/131108/images/131108_000.png)

1、需要选择 ubuntu 版本，可以支持最高 12.4 的cuda驱动。

然后就可以通过webshell登陆了：

![image.png](https://ucloud-blog.cn-bj.ufileos.com/articles/131108/images/131108_001.png)

但是界面启动后需要等待下驱动安装。

**2、直接使用帐号远程登陆**

端口使用8888

ssh root@117.50.xxx.xxx

输入密码就可以操作了

因为没有设置环境变量所以需要执行：

```
export PATH=${PATH}:/home/ubuntu/.local/bin
export HF_ENDPOINT=https://hf-mirror.com
export XINFERENCE_MODEL_SRC=modelscope
export XINFERENCE_HOME=/home/ubuntu/xinf-data
xinference-local --host 0.0.0.0 --port 8888
```

![image.png](https://ucloud-blog.cn-bj.ufileos.com/articles/131108/images/131108_002.png)

模型之能运行一个，重启再运行即可。

```
  File "xoscar/core.pyx", line 284, in __pyx_actor_method_wrapper
    async with lock:
  File "xoscar/core.pyx", line 287, in xoscar.core.__pyx_actor_method_wrapper
    result = await result
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/utils.py", line 45, in wrapped
    ret = await func(*args, **kwargs)
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 629, in launch_builtin_model
    subpool_address, devices = await self._create_subpool(
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 467, in _create_subpool
    else self.allocate_devices(model_uid=model_uid, n_gpu=gpu_cnt)
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 365, in allocate_devices
    raise RuntimeError("No available slot found for the model")
RuntimeError: [address=0.0.0.0:62972, pid=27149] No available slot found for the model
```

模型之能运行一个，重启再运行即可。

```
  File "xoscar/core.pyx", line 284, in __pyx_actor_method_wrapper
    async with lock:
  File "xoscar/core.pyx", line 287, in xoscar.core.__pyx_actor_method_wrapper
    result = await result
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/utils.py", line 45, in wrapped
    ret = await func(*args, **kwargs)
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 629, in launch_builtin_model
    subpool_address, devices = await self._create_subpool(
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 467, in _create_subpool
    else self.allocate_devices(model_uid=model_uid, n_gpu=gpu_cnt)
  File "/home/ubuntu/.local/lib/python3.10/site-packages/xinference/core/worker.py", line 365, in allocate_devices
    raise RuntimeError("No available slot found for the model")
RuntimeError: [address=0.0.0.0:62972, pid=27149] No available slot found for the model
```

### 3、调用接口

可以成功调用接口。测试qwen 大模型速度。

```
curl -X 'POST' 'http://0.0.0.0:8888/v1/chat/completions' -H 'Content-Type: application/json' -d '{
    "model": "qwen1.5-chat","stream": true,
    "messages": [
        {
            "role": "user",
            "content": "北京景点?"
        }
    ],
    "max_tokens": 512,
    "temperature": 0.7
}'
```

### 4、特别注意，不使用需要删除应用

因为运行的方式不一样，不使用了需要删除应用。  
否则还是会产生费用。  
是独享的模型创建的。

- **推荐使用NVIDIA RTX 40 显卡做模型推理，购买地址如下：**

https://www.ucloud.cn/site/active/gpu.html?ytag=seo

https://www.compshare.cn/?ytag=seo