OpenAI GPT-OSS 本地部署指南:Windows Subsystem for Linux (WSL) 适配教程

1. WSL环境准备
  • 启用WSL功能: 以管理员身份运行PowerShell:

    dism.exe /online /enable-feature /featurename:Microsoft-Windows-Subsystem-Linux /all /norestart
    dism.exe /online /enable-feature /featurename:VirtualMachinePlatform /all /norestart
    

    重启计算机后,设置WSL2为默认版本:

    wsl --set-default-version 2
    

  • 安装Linux发行版: 从Microsoft Store安装Ubuntu 22.04 LTS,启动后创建用户名/密码。

2. 系统环境配置

在Ubuntu终端执行:

sudo apt update && sudo apt upgrade -y
sudo apt install -y python3.10 python3-pip build-essential libssl-dev zlib1g-dev
python3 -m pip install --upgrade pip

3. 项目部署
# 克隆仓库
git clone https://github.com/openai/gpt-oss.git
cd gpt-oss

# 安装依赖
python3 -m pip install -r requirements.txt

# 下载模型权重 (以124M模型为例)
python3 download_model.py 124M

4. GPU加速配置 (可选)
# 安装CUDA工具包
sudo apt install -y nvidia-cuda-toolkit

# 验证GPU支持
nvidia-smi  # 应显示GPU信息

# 安装PyTorch CUDA版
python3 -m pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118

5. 运行推理服务

启动API服务:

python3 api_server.py --model_name 124M --device cuda  # 使用GPU
# 或
python3 api_server.py --model_name 124M --device cpu   # 仅CPU模式

6. 验证部署
# 发送测试请求
curl -X POST http://localhost:5000/v1/completions \
  -H "Content-Type: application/json" \
  -d '{"prompt": "人工智能是", "max_tokens": 20}'

预期响应:

{
  "text": "人工智能是... (生成内容)",
  "finish_reason": "length"
}

7. 常见问题解决
  • CUDA内存不足: 修改api_server.pymax_length参数降低序列长度
  • WSL文件权限错误: 避免在Windows目录直接操作,使用/home/username/路径
  • 端口冲突: 修改api_server.pyport参数

性能提示
当使用$$P_{\text{CPU}}$$表示CPU性能时,建议:

  • 124M模型需≥4核CPU
  • 355M模型需≥8核CPU
    使用GPU时,推荐显存容量:
    $$V_{\text{GPU}} \geq 2 \times M_{\text{params}} \text{ (GB)} \quad \text{其中} \ M_{\text{params}} \ \text{为参数量(亿)}$$
Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐