随着AI Agent、自动化工作流技术持续普及,开发者在构建智能应用时经常面临多重难题:不同模态能力对应各自独立API接口,模型数量繁多导致鉴权配置繁琐,多套SDK维护成本高,智能体想要调用图像、视频、语音、知识库能力,需要自行编写大量适配代码。阿里云百炼CLI是百炼平台推出的官方命令行工具,将平台内150多款大模型、十余项全栈AI能力统一封装成命令行指令,以短别名bl或者全名bailian作为调用入口,做到一行命令完成全模态能力调用。不管是开发者本地快速调试AI原型,还是企业环境下AI Agent编排复杂自动化任务,百炼CLI都可以大幅降低集成成本,提升整体开发效率。
区别于网页控制台和传统SDK开发模式,百炼CLI具备三大突出特点。第一是统一能力入口,文本对话、图像生成编辑、视频创作、语音转写合成、视觉理解、联网检索、知识库查询、记忆存储全部收敛到同一套命令,不需要切换多个工具;第二是原生面向Agent设计,对Claude Code、Qoder、OpenClaw、Hermes Agent、Qwen Code等主流智能体框架做适配,Agent可以直接解析命令返回的结构化输出;第三是轻量化脚本友好,无需编写大量业务代码,依靠终端参数即可完成任务,能够嵌入Shell脚本、CI流水线,实现批量自动化处理。详情👉访问阿里云百炼 CLI 页面 或
详情👉访问阿里云百炼大模型服务平台页面 了解

插件化三层技术架构
百炼CLI底层基于Node.js构建,要求运行环境Node.js版本≥18.17.0,推荐使用22.x LTS版本,完整支持Windows、macOS、Linux三大操作系统。整体采用三层插件化架构,分别为核心命令层、能力插件层、平台对接层。
核心命令层:提供bl与bailian基础命令,负责账号鉴权、配置文件管理、版本校验、插件调度分发。配置信息持久化保存在本地,Linux/macOS路径~/.bailian/config.toml,Windows路径%USERPROFILE%\.bailian\config.toml,配置一次之后后续调用无需重复填写密钥。
能力插件层:各类AI能力拆分为独立插件,例如text文本插件、image图像插件、video视频插件、voice语音插件、omni多模态综合插件。插件可以独立安装、卸载、迭代更新,开发者还能够开发自定义插件扩展私有业务能力。
平台对接层:通过统一网关和百炼平台服务交互,支持上百款大模型调用、知识库检索、联网搜索、持久记忆管理。所有命令支持输出纯文本或者JSON结构化数据,方便脚本程序与AI Agent解析处理。
整套架构具备模块化、可扩展、Agent友好的核心特征,各能力插件解耦迭代,自定义插件可以补充业务专属逻辑;输出结构化结果,让Agent能够自动捕获返回内容继续执行后续任务。
快速安装与鉴权配置
环境校验
首先确认本地Node环境版本,版本过低需要升级。
node -v
npm -v
# macOS/Linux升级Node LTS版本
sudo npm install -g n
sudo n lts
一键安装CLI与全套Skills插件
npm install -g bailian-cli && npx skills add modelstudioai/skills --all -g
# 校验安装成功,打印版本号
bl --version
# 查看全部可用命令帮助
bl --help
账号鉴权两种方式
从百炼控制台API密钥管理页面获取API Key。交互式配置适合新手,命令行配置适合自动化脚本。
#方式一:交互式引导配置
bl config
#方式二:直接传入API Key完成登录
bl auth login --api-key sk-你的百炼API密钥
#查看鉴权状态,普通文本输出
bl auth status
#输出JSON格式,专供Agent程序解析
bl auth status --output json
鉴权完成之后,后续所有bl系列命令自动读取本地配置文件,不需要每次携带密钥参数。
核心命令完整实操
1.文本能力 bl text
用于大模型对话、代码生成、长文本创作,支持自定义模型、温度、最大输出token。
#基础对话,使用默认qwen3.7-max模型
bl text chat --message "介绍阿里云百炼CLI的核心功能"
#代码生成,指定旗舰模型,调低temperature提升输出确定性
bl text chat --model qwen3.8-max-preview --message "用Python写一个快速排序算法" --temperature 0.1
#长文章生成,设置最大输出token数量
bl text chat --message "写一篇关于AI Agent发展趋势的深度文章" --max-tokens 8192
#输出重定向保存为markdown文档
bl text chat --message "编写FastAPI项目接口开发规范" > api_spec.md
2.图像能力 bl image
包含文生图、图生图编辑、图片内容理解。
#生成4张赛博朋克夜景图片,输出保存到out文件夹
bl image generate --prompt "A cyberpunk city at night, neon lights, rainy" --n 4 --out-dir ./out/
#图片编辑,基于本地参考图修改画面效果
bl image edit --image ./input.jpg --prompt "将图片中的天空改为星空,添加流星效果"
#图像理解,分析产品截图,输出卖点分析
bl image understand --image ./product.jpg --prompt "分析这张产品图片的卖点与设计亮点"
3.视频能力 bl video
实现文生视频、图片转视频、视频剪辑编辑。
#文本生成短视频,下载保存为sunset.mp4
bl video generate --prompt "Ocean waves at sunset, slow motion, 4K" --download sunset.mp4
#参考图片生成动态视频,设置10秒时长
bl video generate --image ./landscape.jpg --prompt "让图片中的风景动起来,添加流水与飞鸟效果" --duration 10
#视频剪辑,截取前10秒,增加字幕背景音乐
bl video edit --video ./input.mp4 --prompt "剪辑视频前10秒,添加背景音乐与字幕"
4.语音能力 bl voice
TTS语音合成、ASR音频识别转文字。
#中文女声合成输出hello.mp3
bl voice tts --text "你好,欢迎使用阿里云百炼CLI" --voice "cosyvoice-zh-female-01" --out hello.mp3
#识别会议录音音频输出文本
bl voice asr --url ./meeting.mp3 --language zh --format text
#英文语音合成
bl voice tts --text "Hello, welcome to Alibaba Cloud Bailian CLI" --voice "cosyvoice-en-male-01" --out hello_en.mp3
5.多模态综合能力 bl omni
支持文本、图片、音频混合输入,做综合理解分析。
#图片+文本提问,解析产品图片生成产品文案
bl omni --message "分析这张图片并生成对应的产品描述" --image ./product.jpg
#音频+文本,总结录音文件核心内容
bl omni --message "总结这段音频的核心内容" --audio ./speech.mp3
6.搜索、知识库、记忆工具命令
联网搜索、企业知识库查询、持久记忆读写,弥补大模型知识滞后问题。
#联网搜索,自动总结返回结果
bl search --query "阿里云百炼CLI最新功能" --summary
#查询企业内部知识库
bl kb query --name "企业产品知识库" --query "百炼CLI的安装方法"
#写入记忆
bl memory save --key "cli-install" --value "npm install -g bailian-cli"
#读取记忆
bl memory query --key "cli-install"
7.辅助工具命令
#列出平台全部可用模型
bl model list
#查看子命令详细帮助,例如text chat子命令
bl text chat --help
#更新CLI工具版本
npm update -g bailian-cli
多业务场景实战案例
场景一:电商素材自动化流水线
一条命令串联图片生成、文案撰写、视频生成,完成商品全套素材产出,适合电商运营自动化脚本。
#生成6张T恤商品主图
bl image generate --prompt "Pure black summer men's T‑shirt, Amazon main image, white background, high detail" --n 6 --out-dir ./t-shirt-images/
#基于图片生成商品文案,写入markdown文件
bl text chat --message "基于生成的T恤图片,撰写亚马逊产品标题、五点描述与A+页面内容" --max-tokens 4096 > product_description.md
#使用第一张商品图生成动态宣传短视频
bl video generate --image ./t-shirt-images/1.jpg --prompt "Dynamic product display, add text overlay with product features" --duration 15 --download t-shirt-video.mp4
场景二:会议音频全流程处理
音频转写、纪要总结、语音播报总结稿,适合日常办公自动化脚本。
#音频识别转文字,输出文本文件
bl voice asr --url ./meeting.mp3 --language zh --format text > meeting_transcript.txt
#读取转写文件,提取会议决策、行动项
bl text chat --message "总结这份会议纪要,提取核心决策、行动项与责任人" --file ./meeting_transcript.txt > meeting_summary.md
#把总结文档合成播报音频
bl voice tts --text "$(cat meeting_summary.md)" --voice "cosyvoice‑zh‑male‑01" --out meeting_summary_podcast.mp3
场景三:代码项目辅助开发
自动生成README文档、代码审查、批量输出单元测试,适配CI脚本。
#读取项目主文件生成项目说明文档
bl text chat --message "基于Python项目代码,生成完整的README.md文档,包含安装、配置、使用示例" --file ./main.py > README.md
#代码审查输出优化报告
bl text chat --model qwen3.8-max-preview --message "审查这段Python代码,找出Bug并提供优化方案" --file ./app.py > code_review.md
#自动生成单元测试
bl text chat --message "为这段代码生成完整的单元测试用例" --file ./app.py > test_app.py
AI Agent框架集成实战
百炼CLI原生面向Agent设计,主流智能体框架可以直接调用,也可以在Python代码中调用子进程执行CLI指令,实现自定义智能体。
1.Claude Code接入配置
#全局安装Claude Code
npm install -g @anthropic‑ai/claude‑code
mkdir -p ~/.claude
nano ~/.claude/settings.json
settings.json配置内容:
{
"env": {
"ANTHROPIC_AUTH_TOKEN": "YOUR_API_KEY",
"ANTHROPIC_BASE_URL": "https://coding.dashscope.aliyuncs.com/apps/anthropic",
"ANTHROPIC_MODEL": "qwen3.7-max"
}
}
配置完成后执行claude启动,Agent内部可以直接调用bl全套命令。
2.OpenClaw集成
npm install -g openclaw
openclaw config set bailian.apiKey sk-你的百炼API密钥
openclaw config set bailian.model qwen3.8-max-preview
openclaw
3.Python调用子进程封装百炼CLI(自定义Agent开发)
import subprocess
import json
def call_bailian_cli(command):
"""封装调用百炼CLI,捕获输出结果"""
result = subprocess.run(command, shell=True, capture_output=True, text=True)
if result.returncode == 0:
return result.stdout.strip()
else:
raise Exception(f"CLI调用失败: {result.stderr.strip()}")
#调用文本对话,获取JSON结构化返回
response = call_bailian_cli('bl text chat --message "用Python调用百炼CLI" --output json')
print(json.loads(response))
#调用图像生成任务
call_bailian_cli('bl image generate --prompt "AI Agent logo" --out-dir ./agent-logo/')
产品核心优势与选型判断
核心优势
- 全能力统一入口:整合十余类AI能力,对接150+大模型,只需要掌握一套命令,不用维护多套SDK与API。
- 原生适配AI Agent:输出支持JSON结构化,主流智能体框架开箱即用,大幅降低智能体开发工作量。
- 跨平台兼容:Windows/macOS/Linux全部支持,本地电脑、远程服务器、CI流水线都可以运行。
- 脚本化自动化:命令行可嵌入Shell、Python脚本,批量处理文本、图片、音视频素材,提升自动化效率。
- 同步平台迭代:跟随百炼平台持续更新模型、新增能力,无需手动修改业务代码。
适用场景
优先选用百炼CLI的业务场景:
- AI Agent开发,需要快速接入多模态大模型能力;
- 需要做自动化任务编排,批量处理文本、图像、视频、语音素材;
- 开发者快速调试模型效果,不想编写复杂SDK代码;
- 企业自动化流水线、CI流程内嵌入AI能力。
替代选择:简单单次对话任务,直接使用网页控制台;大型复杂业务系统,可以SDK和CLI组合使用。
结语
百炼CLI的出现,标志AI能力调用进入命令行统一、Agent原生适配、全模态一体化的新阶段。它把原本分散的文本、图像、视频、语音、知识库、联网搜索全部收拢到统一命令行入口。对于普通开发者,省去对接多套API的繁琐工作,一行命令就可以完成原型调试、素材批量生成;对于AI Agent,它相当于一套外置能力工具箱,让智能体不再局限文本输出,可以直接生成图片、视频、音频,完成现实世界的复杂任务。详情👉访问阿里云百炼 CLI 页面 或
详情👉访问阿里云百炼大模型服务平台页面 了解

随着平台持续迭代,百炼CLI会不断接入更多模型与工具插件。不管是个人开发者快速验证想法,还是企业构建大规模智能体自动化流水线,百炼CLI都可以作为高效的底层工具,释放AI生产力。