保姆级教程:在阿里云百炼AI模型平台调用DeepSeek-V4-Pro(免费100万Tokens)

简介: 本文介绍如何通过阿里云百炼平台调用DeepSeek-V4开源模型:开通百炼(享免费额度)、创建API Key,再下载Chatbox客户端,图形化配置deepseek-v4-pro模型即可使用,免命令行与运维,支持高可用与自动扩缩容。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

如何通过百炼平台调用 DeepSeek-V4 开源模型,百炼平台提供标准化接口,免去了自行构建模型服务基础设施的麻烦,并支持负载均衡及自动扩缩容,确保了 API 调用的高稳定性。先开通百炼平台,并创建API Key,然后下载 Chatbox 可视化界面客户端,填写百炼API Key,然后调用deepseek-v4-pro,用户无需进行命令行操作,即可通过直观的图形界面轻松完成 deepseek-v4-pro 模型的配置与使用。


一、创建阿里云账号

如果您还没有阿里云账号,先注册阿里云账号,根据页面提示完成注册。阿里云账号是您使用云资源的付费实体,因此是部署方案的必要前提。


二、开通阿里云百炼平台

开通百炼:https://www.aliyun.com/product/bailian  可以免费领取超7000万Tokens,deepseek-v4-pro模型免费100万Tokens,如下图: deepseekv4pro.jpg

首次开通百炼后,平台会自动为您发放各模型的新人专属免费额度(有效期:30至90天),用于模型推理服务。超出额度或期限将产生费用,具体费用请以控制台的实际报价和最终账单为准。免费额度领取方法和详情,请查看:新人免费额度页面


三、获取百炼API Key

1、前往阿里云百炼的API Key页面,如下图:

创建百炼APIKey.jpg

2、在 API-Key 页签下,创建或查看 API Key,如上图所示,点击【创建API Key】


四、使用 Chatbox 调用模型


1、访问 Chatbox 下载地址 下载并安装客户端,本方案以 Windows 为例

image.png

2、运行并配置 vLLM API ,单击设置

image.png

3、在设置页面的左侧导航中,选择模型提供方,然后单击下方的添加按钮,按照如下表格进行配置

项目

说明

示例值

模型提供方

下拉选择模型提供方。

Qwen

API 密钥

填写模型服务调用 API 密钥。

上一步骤获取的百炼API Key

模型

单击模型右侧的新建,完成模型添加。

说明

模型ID:

deepseek-v4-pro

显示名称:

deepseek-v4-pro

模型类型:聊天

能力:推理

上下文窗口:1000000

最大输出Token数:4096

deepseek-v4-pro


说明:可选模型:deepseek-v4-flash。


4、保存配置信息后,即可回到聊天页面,选择刚刚配置的模型进行对话。

相关文章
|
3天前
|
人工智能 JSON 安全
|
3天前
|
云安全 人工智能 安全
|
3天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
695 0
|
3天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
724 0
|
5天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
649 25
|
4天前
|
人工智能 测试技术 语音技术
Qwen-Audio-3.0-TTS 正式发布!AI 语音从 “能说话” 升级到 “会带情绪表达”
阿里云发布Qwen-Audio-3.0-TTS语音合成大模型,支持细粒度标签控制(如[gasp][angry])、freestyle自由风格、16种语言及20种方言,声学鲁棒性强。含Flash(首包延时300ms)和Plus(全球榜单冠军)双版本,已在百炼平台开放调用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
591 1
|
4天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
518 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
|
11天前
|
缓存 UED 开发者
Codex109天重置23次,明天还要再送一次
Codex近109天完成23次额度重置,7月14日将迎来第24次。Tibo高频响应用户反馈:优化GPT-5.6高消耗问题、补发失效福利、调整重置时间——形成“反馈→回应→修复→补偿”正向闭环,彰显以用户为中心的产品哲学。(239字)
910 12

热门文章

最新文章