阿里云计算巢 × ComfyUI × SenseNova-U1.5:一键部署原生多模态统一模型,文生图 / 图像编辑 / 文字渲染与复杂版式编排一次搞定,原生 4K 高清直出。
一、模型简介
SenseNova-U1.5-8B-MoT 是商汤科技推出的原生多模态统一模型,基于 NEO-unify 架构将多模态理解、推理与生成融于一体,采用 8B 参数的 MoT(Mixture-of-Transformers)设计,现已开放权重并原生适配 ComfyUI。核心亮点:
- 理解生成一体化:单一模型同时覆盖图像理解、视觉推理与图像生成,无需多模型组合
- 原生 4K 输出:原生支持 3-4K 分辨率高清图像生成,直出商用级素材
- 文字渲染与版式编排:海报、信息图、多文字复杂版式一次生成,长指令、多约束稳定可控
- 高质量图像编辑:自然语言指令完成局部修改、风格调整与元素替换,保持度高
- 轻量高效:8B MoT 架构显存占用友好,常规 GPU 规格即可运行
官方Github仓库:https://github.com/OpenSenseNova/SenseNova-U1
二、一键部署
通过阿里云计算巢模型市场,选择 SenseNova-U1.5 即可一键部署 ComfyUI 环境,模型文件自动下载,无需手动配置。
部署步骤:
- 打开计算巢模型市场,搜索「SenseNova-U1.5」,点击立即部署;
- 选择地域、实例规格(GPU 型号)、付费方式等参数;
- 确认订单并创建服务实例。部署时会自动下载模型文件,请耐心等待服务实例创建完成;
- 部署完成后,服务输出中会给出 ComfyUI 的访问地址。
资源要求:
项目 |
说明 |
部署形态 |
ECS 单机版(GPU 云服务器) / 容器集群版 |
磁盘空间 |
模型权重约 35GB,部署模板默认预留 300GB 数据盘 |
推荐 GPU |
入门版工作流需 40GB 以上显存,推荐 NVIDIA L20 / H20 等 48GB 及以上规格 |
三、打开 ComfyUI 并加载工作流
1. 加载示例工作流
- 打开部署输出中的 ComfyUI 访问地址,进入 ComfyUI 界面;
- 选择 工作流 页面, 直接打开对应示例工作流,即可进行图片/海报生成;
工作流只用到两个专用节点,结构极简:
- SenseNovaU1LocalLoader:加载本地模型,默认指向
/root/ComfyUI/models/sensenova/SenseNova-U1.5-8B-MoT,bf16 精度、cuda 设备; - SenseNovaU1LocalTextToImage:输入提示词并控制输出,默认 2720×1536(16:9)分辨率;
- SaveImage:保存生成结果。
计算巢部署时模型文件已自动下载到对应目录,无需手动操作:
ComfyUI/models/sensenova/SenseNova-U1.5-8B-MoT/ ├── model-00001-of-00008.safetensors # 统一权重,8 个分片共约 35GB ├── ... ├── model-00008-of-00008.safetensors ├── config.json # 模型配置 └── tokenizer 相关配置 # 文本分词器
💡 与常见「扩散模型 + 文本编码器 + VAE」多文件组合不同,SenseNova-U1.5 基于 NEO-unify 架构无需 VE/VAE,MoT 统一权重单一模型即承担理解与生成全部任务。
四、应用场景
- 海报与营销物料:文字与版式一次生成,4K 直出商用海报、Banner 与社媒配图
- 电商视觉设计:商品图背景替换、场景合成与细节编辑,显著降低拍摄与修图成本
- 图文内容创作:复杂构图与多主体空间关系稳定可控,适合插画、绘本与封面设计
- 信息图与数据可视化:长指令 + 文字渲染能力突出,一句话生成带标题、标注、图例的完整信息图
- 企业视觉中台:轻量 8B 架构部署成本低,理解 + 生成一体,适合批量内容生产管线
五、相关链接
- 计算巢模型市场(SenseNova-U1.5):从计算巢控制台「模型市场」搜索 SenseNova-U1.5 进入
- 模型权重仓库(huggingface):https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT
- 项目主页(GitHub):https://github.com/OpenSenseNova/SenseNova-U1
- 商汤日日新官方:https://www.sensenova.cn
七、技术支持
钉钉群:
如有部署或使用问题,欢迎联系您的阿里云客户经理获取支持。