对于刚接触大模型开发的个人开发者、学生、创业团队来说,经常会混淆百炼平台不同官方入口,分不清产品官网和管理控制台各自的定位,出现领不到免费Tokens、找不到API‑Key、不知道去哪里查看用量消耗,甚至选错计费模式带来不必要成本。百炼平台分为前台产品官网与后台管理控制台两套独立入口,二者分工明确,官网偏向产品介绍、计费展示、新人免费资源领取;控制台偏向实际开发,包含API‑Key管理、模型广场、免费额度查询、订阅套餐购买、调用监控等核心运维能力。新开通账号可领取合计超7000万Tokens新人免费资源,每款主流模型分配100万Tokens试用额度,同时平台支持按量付费、TokenPlan、CodingPlan多种计费模式,适配学习原型验证、个人开发、企业团队不同层级需求。本文完整拆解两大入口功能定位,梳理免费额度查看路径,提供环境变量配置、curl、Python可直接运行代码示例,讲解不同计费模式选型,汇总高频踩坑点,帮助开发者快速完成从账号开通到接口调用的完整流程。详情👉访问阿里云百炼大模型服务平台页面 了解。


一、两大官方入口定位与功能区分
1. 前台产品官网
产品官网面向普通用户、业务决策者,主打产品信息展示。在这里可以完整浏览平台能力介绍、各款大模型参数说明、不同计费模式报价方案,完成新人免费Tokens资源领取,了解各类限时优惠活动。官网不提供密钥创建、接口调用、用量明细查询这类后台运维能力,只做信息展示与权益领取。
访问官网之后,可以浏览平台支持的全部模型列表,了解Qwen系列、DeepSeek、GLM、MiniMax、Kimi等模型的能力差异,对比按量付费、各类订阅套餐的成本,领取新人千万级免费Tokens权益。领取完成之后,实际开发工作需要跳转至控制台完成。
注意:免费权益领取不等于可以直接调用API,领取后还需要进入控制台,开通对应地域服务、创建API‑Key,才可以发起模型推理请求。
2. 后台管理控制台
控制台是开发者的核心工作后台,绝大多数开发运维操作都在这里完成,是编写代码调用大模型必须使用的入口。核心功能清单:
- 地域切换:支持华北2(北京)、新加坡、法兰克福、香港等多个地域,新人免费额度仅华北2(北京)地域生效。
- API‑Key管理:创建、删除、重置访问密钥,支持主账号、RAM子账号密钥,区分普通按量密钥与TokenPlan/CodingPlan专属密钥。
- 模型广场:浏览全部可用模型,查看单模型免费额度余量,一键测试对话体验。
- 免费额度管理页面:集中查看全部模型剩余免费Tokens、到期时间、用完即停开关。
- 套餐订阅:开通TokenPlan个人/团队版、CodingPlan编码套餐,购买节省计划、用量资源包。
- 用量与监控:查看Token消耗统计、调用成功率、请求耗时,导出用量报表。
- 业务空间管理:创建多个业务空间,实现团队权限隔离、成本独立核算。
重要规则:不同地域的API‑Key、接入域名、模型资源完全隔离,密钥不能跨地域混用。 例如北京地域生成的API‑Key不能直接用于新加坡地域接口,很多新手调用报错就是因为地域不匹配。详情👉访问阿里云百炼大模型服务平台页面 了解。


二、新人免费Tokens资源说明与三种查看方式
新用户开通百炼平台,华北2(北京)地域自动发放免费推理Tokens,整体合计超7000万Tokens,每一个主流模型独立分配100万Tokens,模型之间额度池互相独立,快照版本与滚动最新版本也视为两套独立额度,额度不能跨模型转移,系统也不会自动切换尚有额度的模型,代码中model参数写哪一个模型,就只会消耗该模型的免费额度。
免费额度只抵扣实时推理调用,Batch批量任务、模型微调、模型部署、存储相关开销,不在抵扣范围;主账号与RAM子账号共享同一个模型的免费额度池,子账号大量调用会耗尽整个账号体系的免费资源。
查看剩余免费Tokens的三种途径:
- 免费额度汇总页面(控制台):集中展示所有模型,剩余Token、到期时间、用完即停开关,页面卡片统计有额度模型数量、高使用率模型,适合批量管理全部模型资源。
- 模型广场单模型详情页:点开目标模型,选择对应的快照版本,页面下方进度条展示剩余/总免费额度,例如
362917 / 1000000,代表剩余36万多Token。适合确认某一个特定模型余量。 - 模型用量监控页面:查看历史消耗趋势,排查额度快速耗尽的原因,定位异常调用。
控制台额度数据为分钟级异步更新,执行调用之后需要手动刷新页面,才可以看到最新消耗数字。同时建议测试阶段开启用完即停开关,免费额度耗尽接口直接返回403错误码
AllocationQuota.FreeTierOnly,防止实名认证账号自动转入按量付费产生意外账单。未实名认证账号强制开启用完即停,无法关闭。
三、API‑Key获取与环境变量配置实操
进入控制台,先切换至华北2(北京)地域,进入API‑Key管理页面创建密钥。创建密钥的时候,可以选择归属主账号或者RAM子账号,选择归属业务空间,配置IP白名单、可访问模型范围。密钥明文只会展示一次,复制保存,如果丢失只能重置,旧密钥直接失效。详情👉访问阿里云百炼大模型服务平台页面 了解。


区分两类密钥:普通通用API‑Key会优先抵扣新人免费Tokens;TokenPlan、CodingPlan专属sk‑sp‑开头密钥,不会消耗新人免费额度,直接抵扣订阅套餐Credits。测试免费额度必须使用普通通用密钥。
Linux / macOS终端配置环境变量
# 设置百炼通用API密钥
export DASHSCOPE_API_KEY="sk-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
# 北京地域OpenAI兼容接口地址
export BAILIAN_COMPAT_URL="https://dashscope.aliyuncs.com/compatible-mode/v1"
# 校验环境变量是否生效
echo $DASHSCOPE_API_KEY
Windows PowerShell配置环境变量
$env:DASHSCOPE_API_KEY="sk-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
$env:BAILIAN_COMPAT_URL="https://dashscope.aliyuncs.com/compatible-mode/v1"
开发规范:禁止将密钥硬编码写进源代码,禁止提交代码仓库,生产环境优先使用密钥管理服务。
四、可直接运行代码调用示例
curl命令行快速测试调用(消耗新人免费额度)
curl $BAILIAN_COMPAT_URL/chat/completions \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H "Content‑Type: application/json" \
-d '{
"model":"qwen‑plus",
"messages":[
{"role":"system","content":"你是开发助手,回答简洁"},
{"role":"user","content":"简单介绍百炼平台两大入口区别"}
],
"temperature":0.7,
"max_tokens":1024
}'
Python完整调用示例(OpenAI兼容SDK)
首先安装依赖包:
pip install openai
完整可运行代码:
import os
from openai import OpenAI
# 读取环境变量中的密钥与接口地址
client = OpenAI(
api_key=os.environ.get("DASHSCOPE_API_KEY"),
base_url=os.environ.get("BAILIAN_COMPAT_URL")
)
def llm_test_call(model_id, prompt_text):
messages = [
{
"role":"system", "content":"你是开发者测试助手,用于验证免费额度调用是否正常。"},
{
"role":"user", "content":prompt_text}
]
try:
resp = client.chat.completions.create(
model=model_id,
messages=messages,
temperature=0.6,
max_tokens=1024,
stream=False
)
print("模型返回结果:")
print(resp.choices[0].message.content)
usage = resp.usage
print(f"\n输入Token:{usage.prompt_tokens} 输出Token:{usage.completion_tokens}")
return resp
except Exception as err:
err_info = str(err)
if "AllocationQuota.FreeTierOnly" in err_info:
print("【告警】该模型免费额度耗尽,用完即停拦截请求。")
else:
print(f"调用异常:{err_info}")
return None
if __name__ == "__main__":
# 使用拥有免费额度的模型
llm_test_call("qwen‑plus","写一段简单python冒泡排序代码")
官方dashscope SDK调用示例
pip install dashscope
import os
import dashscope
dashscope.api_key = os.environ.get("DASHSCOPE_API_KEY")
from dashscope import Generation
resp = Generation.call(
model="qwen‑flash",
messages=[{
"role":"user","content":"解释API‑Key和地域之间的关系"}],
result_format='message'
)
if resp.status_code == 200:
print(resp.output.choices[0].message.content)
else:
print(f"错误码:{resp.code},错误信息:{resp.message}")
五、百炼三类计费模式完整对比选型
平台提供三类主流计费方案,开发者根据自身业务规模选择,全部在控制台完成开通与管理:
- 按量付费:按实际Token消耗计费,适合原型验证、调用量波动大的业务;新账号优先消耗新人免费Tokens,额度耗尽之后按单价扣费。适合学习、小体量测试。
- TokenPlan订阅套餐:分为个人版、团队版,使用Credits统一计量,支持文本、图像、视频多模态模型,兼容大量第三方AI工具。个人版采用7天滚动窗口额度;团队版按月席位Credits,具备成员管理、用量审计、算力隔离,适合重度Agent开发、多人团队。注意TokenPlan专属密钥不消耗新人免费额度。
- CodingPlan编码订阅:面向AI编程场景,按月按请求次数限制额度,适配Cursor、OpenClaw、Qoder等编程工具,适合以代码开发为主的个人开发者。
选型参考:
- 学习、原型POC:优先使用新人免费额度 + 按量付费;记得开启用完即停防护。
- 个人重度AI编码开发:评估CodingPlan。
- 个人多模态、大量Agent调试:选择TokenPlan个人版。
- 企业多人协作、需要权限管控:选择TokenPlan团队版。
六、高频问题排查汇总
- 领完免费Tokens,调用却没有消耗免费额度:确认接口使用华北2(北京)地域域名;确认使用普通通用API‑Key,不是TokenPlan专属sk‑sp‑密钥;确认model参数对应的模型还有剩余免费额度。
- API调用返回401鉴权失败:核对API‑Key是否复制完整;确认地域和密钥地域匹配;密钥是否被重置删除。
- 报错
AllocationQuota.FreeTierOnly:目标模型免费额度耗尽,用完即停功能拦截调用;更换有免费额度的model,或者关闭用完即停切换按量付费。 - RAM子账号调用,免费额度快速耗尽:主账号和RAM子账号共享该模型的免费额度,做好RAM账号调用权限管控。
- 切换模型快照版本,发现没有免费额度:快照版本和滚动版本额度池独立,修改model参数确认目标版本余量。
- 官网领取免费资源,控制台看不到额度:确认地域切换为华北2(北京);刚领取存在最多两小时下发延迟,等待并刷新页面。
七、最佳实践落地建议
- 区分官网与控制台职责:官网用于了解产品、领取新人权益;真正开发调试全部操作在控制台。
- 开发前优先校验地域:新人免费额度仅华北2(北京)地域生效,不要使用新加坡、法兰克福等其他地域测试免费资源。
- 安全管控API‑Key,禁止硬编码密钥,RAM账号最小权限分配,离职人员及时回收密钥。
- 测试环境务必开启用完即停开关,避免脚本死循环、定时任务不停调用带来意外账单。
- 代码中明确写死model参数,不要依赖系统自动切换模型;快照版本和滚动版本额度互不互通。
- 定期查看免费额度页面监控使用率,使用率超过80%提前规划切换按量付费或者订阅套餐。
- 分清不同类型密钥用途:普通密钥用于消耗免费额度;TokenPlan/CodingPlan专属密钥用于订阅套餐场景,二者不可混用。
- 批量微调、Batch异步任务,不能使用新人免费额度抵扣,提前评估这部分业务成本。
总结
百炼平台分为前台产品官网、后台控制台两套核心入口,分工清晰。产品官网用于浏览产品介绍、报价信息、领取新人超7000万Tokens免费权益;控制台是开发者核心后台,完成API‑Key创建、地域切换、免费额度查询、订阅套餐管理、调用监控。新人免费额度仅限华北2(北京)地域,各个模型额度互相独立,主账号与RAM子账号共享额度池,开启用完即停可以规避实名账号意外扣费风险。
开发者可以使用curl、Python SDK完成接口调用,同时平台支持按量付费、TokenPlan、CodingPlan三类计费模式,覆盖从个人学习到企业团队不同场景。在实际开发过程中,注意地域、密钥类型、model参数三者匹配,做好密钥安全管理、用量监控,就可以低成本完成大模型原型开发与业务验证。当免费额度耗尽,再结合业务调用规模,选择适合自己的付费模式平稳过渡至正式业务开发。