开发者社区 问答 正文

阿里云国际ECS如何部署 Qwen3 大模型?

阿里云国际ECS如何部署 Qwen3 大模型?

展开
收起
云渠道商yunshuguoji 2026-08-03 13:55:27 29 分享 版权
1 条回答
写回答
取消 提交回答
  • 专注分享|知识干货|避坑指南 有注册开户类、云领域知识等不了解的问题可以问我哦

    本文由阿里云国际云服务器代理商:云枢国际yunshuguoji撰写。
    前期做好准备后就创建并登录 ECS:
    阿里云国际控制台→ECS→Create Instance,选对应 GPU 规格、Ubuntu22.04 GPU 镜像,设置登录密码。
    SSH 远程连接 ECS 公网 IP(端口 22)。

    一键安装依赖(复制整条运行)
    apt update && apt install git python3-pip -y
    pip3 install torch transformers accelerate vllm streamlit modelscope

    高速下载 Qwen3(阿里 ModelScope 国际镜像,无需 HF 翻墙)
    以 Qwen3-8B-Instruct 举例:
    from modelscope import snapshot_download
    下载模型到本地
    model_dir = snapshot_download('Qwen/Qwen3-8B-Instruct')
    执行方式:输入python3进入交互窗口,粘贴上面代码,等待下载完成。

    方式 1:可视化 Web 对话(本地调试)
    新建chat.py
    from transformers import AutoTokenizer, AutoModelForCausalLM
    model_dir = "./Qwen3-8B-Instruct"
    tokenizer = AutoTokenizer.from_pretrained(model_dir)
    model = AutoModelForCausalLM.from_pretrained(model_dir, device_map="auto")

    import streamlit as st
    st.title("Qwen3 对话")
    prompt = st.text_input("输入提问")
    if prompt:
    inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
    outputs = model.generate(**inputs, max_new_tokens=512)
    st.write(tokenizer.decode(outputs[0], skip_special_tokens=True))
    启动 Web 服务:
    streamlit run chat.py --server.address=0.0.0.0 --server.port=8501
    浏览器访问 ECS公网IP:8501 即可对话。
    方式 2:OpenAI 标准 API(业务程序调用,推荐生产)
    vLLM 高性能启动接口:
    python -m vllm.entrypoints.openai.api_server \
    --model ./Qwen3-8B-Instruct \
    --port 8000 \
    --host 0.0.0.0

    2026-08-03 14:16:54
    赞同 89 展开评论
问答分类:
问答地址: