01 DeepSeek-V3.2-Exp模型介绍

DeepSeek-V3.2-Exp ,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。

DeepSeek Sparse Attention(DSA)首次实现了细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现了长文本训练和推理效率的大幅提升。

图片

虽然网上有很多介绍 DeepSeek-V3.2-Exp 的文章,但关于部署的内容仍然非常少见。

02 DeepSeek-V3.2-Exp部署教程

下面带大家实操一下 部署流程,本次演示会在 九章智算云 上完成部署。

如何大家没有注册,点击注册就行。

https://www.alayanew.com?id=online01

1、点击产品 -> 云容器实例

2、点击新建云容器

3、选择自己想要的GPU显卡和镜像

小编这个是自己打的镜像,如果大家想跑deepseek,可以私信小编,小编可以将镜像共享给大家。

4、根据需求是否需要定时关机,就直接点击开通

5、开通后点击云容器实例 -> 点击web连接的图标

6、启动DeepSeek-V3.2-Exp(无需下载,镜像自动挂载好公共目录模型文件)

    python3 -m sglang.launch_server \
        --model-path /root/public/DeepSeek-V3___2-Exp \
        --host 0.0.0.0 \
        --port 30000 \
        --tp 8

    7、回到云容器实例 -> 点开放端口图标

    8、输入30000 ,(因为启动的端口是30000)点击生成

    9、部署OpenWebui-选择五区

    10、选择自己想要的GPU显卡和镜像

    小编这个是自己打的镜像,如果大家想用,可以私信小编,小编可以将镜像共享给大家。

    11、开通后点击云容器实例 -> 点击web连接的图标

    12、启动OpenWebui

    export WEBUI_AUTH=false
    export ENABLE_OLLAMA_API=false
    export OPENAI_API_BASE_URLS="http://183.166.183.174:30024/v1" (注意:
    这里要换成自己的deepseek模型地址,就是刚刚部署的deepseek)
    sh dev.sh

    13、回到云容器实例 -> 点开放端口图标

    14、输入8080 ,(因为启动的端口是8080)点击生成

    这样就 完成了部署

    如果你对DeepSeek-V3.2-Exp部署感兴趣,欢迎随时私信小编

    现在注册 九章智算云,可领取 算力体验优惠券 🎁 —— 无门槛使用,免费上手体验,机会难得!

    注册地址:https://www.alayanew.com?id=online01

    https://www.alayanew.com?id=online01

    记得一键3连

    如有推理、微调、算力等需求,可以联系作者本人,本人提供一对一的技术支持。

    Logo

    Agent 垂直技术社区,欢迎活跃、内容共建。

    更多推荐