最强开源背景去除模型​RMBG v1.4

简介: RMBG v1.4是briaai公司最先进的背景去除模型,它可以将一系列类别和图像类型中有效地将前景与背景切分

BRIA Background Removal v1.4

RMBG v1.4是briaai公司最先进的背景去除模型,它可以将一系列类别和图像类型中有效地将前景与背景切分。RMBG v1.4是在精心挑选的数据集(库存图像、电子商务、游戏和广告内容)上进行了训练,使其非常适合为大规模企业内容创建提供动力的商业用例。准确性、效率和多功能性目前可以与领先的源可用模型相媲美。在内容安全、合法许可的数据集和偏见缓解至关重要的地方,这是理想的。目前RMBG v1.4可作为非商业用途的源可用模型。

模型说明

  • 开发者: BRIA AI
  • 模型类型:背景去除
  • 许可证: bria-rmbg-1.4

    • 该模型根据知识共享许可发布,用于非商业用途。
    • 商业用途须遵守与 BRIA 的商业协议。联系我们获取更多信息。
  • 模型描述: BRIA MBG 1.4 是专门在专业级数据集上训练的显着性分割模型。

训练图像分布

Category Distribution
仅对象 45.11%
有物体/动物的人 25.24%
仅限人 17.35%
带有文字的人/物体/动物 8.52%
纯文本 2.52%
仅限动物 1.89%
Category Distribution
逼真 87.70%
非真实感 12.30%
Category Distribution
非纯色背景 52.05%
纯色背景 47.95%
Category Distribution
单个主要前景对象 51.42%
前景中有多个对象 48.58%

效果对比

官方效果

examples

实测效果

通过魔哈仓库下载

下载安装

git clone https://moha.xiaoshiai.cn/briaai/models/RMBG-1.4.git
cd RMBG-1.4/
pip install -r requirements.txt

也可以注册魔哈账号, 使用魔哈专属CDN加速从HuggingFace上下载模型

运行

from skimage import io
import torch, os
from PIL import Image
from briarmbg import BriaRMBG
from utilities import preprocess_image, postprocess_image

im_path = f"{os.path.dirname(os.path.abspath(__file__))}/example_input.jpg"

net = BriaRMBG()
device = torch.device("cuda" if torch.cuda.is_available() else "cpu")
net = BriaRMBG.from_pretrained("briaai/RMBG-1.4")
net.to(device)

# prepare input
model_input_size = [1024,1024]
orig_im = io.imread(im_path)
orig_im_size = orig_im.shape[0:2]
image = preprocess_image(orig_im, model_input_size).to(device)

# inference 
result=net(image)

# post process
result_image = postprocess_image(result[0][0], orig_im_size)

# save result
pil_im = Image.fromarray(result_image)
no_bg_image = Image.new("RGBA", pil_im.size, (0,0,0,0))
orig_image = Image.open(im_path)
no_bg_image.paste(orig_image, mask=pil_im)
no_bg_image.save("example_image_no_bg.png")

晓石AI

关注"晓石AI" 了解我们更多产品

目录
相关文章
|
7月前
|
人工智能
搞懂这7个配置文件让你的OpenClaw变智能助手
很多人装了满满一堆Skills,却觉得OpenClaw还是"傻白甜"。其实决定AI智商的,不是插件有多少,而是这几个藏在系统底层的配置文件。
5572 8
|
10月前
|
机器学习/深度学习 人工智能 自然语言处理
Z-Image:冲击体验上限的下一代图像生成模型
通义实验室推出全新文生图模型Z-Image,以6B参数实现“快、稳、轻、准”突破。Turbo版本仅需8步亚秒级生成,支持16GB显存设备,中英双语理解与文字渲染尤为出色,真实感和美学表现媲美国际顶尖模型,被誉为“最值得关注的开源生图模型之一”。
5976 9
|
机器学习/深度学习 人工智能 并行计算
BEN2:一键快速抠图!自动移除图像和视频中的背景,支持在线使用
BEN2 是由 Prama LLC 开发的深度学习模型,专注于从图像和视频中快速移除背景并提取前景,支持高分辨率处理和GPU加速。
1662 10
BEN2:一键快速抠图!自动移除图像和视频中的背景,支持在线使用
|
7月前
|
人工智能 缓存 文字识别
OpenClaw进阶指南:阿里云/本地部署+API配置+多模态融合+跨平台联动实战手册
2026年,AI技术的核心进化方向已从单一文本交互转向多模态融合,OpenClaw(曾用名Clawdbot)凭借开放的插件生态与灵活的部署架构,率先实现“文本、图像、语音、视频”的全维度交互支持。无论是通过语音下达复杂任务、让AI分析视频核心信息,还是上传图像实现智能识别,OpenClaw都能打破信息形态的边界,成为连接虚拟与现实的高效桥梁。
1232 16
|
8月前
|
运维 JavaScript 前端开发
拿 GLM-5 重构了一个真实项目,跟 Claude Opus 比了比
GLM-5 正式迈向“Agentic Engineering”:实测其Agent在1.2万行Node.js项目中完成Express路由迁移,8文件全改、测试全过,仅需微调2处;Benchmark紧追Claude Opus,开源模型第一。适合后端重构、文档生成与长周期运维,尚不擅前端与模糊需求。
3503 1
|
11月前
|
人工智能 物联网 测试技术
Qwen-Image-Edit:全能图像编辑,驱动内容创作提质增效
通义千问团队开源Qwen-Image-Edit,基于20B模型,支持语义与外观双重编辑、精准中英文文字修改,具备SOTA图像编辑能力,可用于IP创作、风格迁移、文字修复等。
7324 6
|
移动开发 安全 虚拟化
VMware ESXi 6.7 U3v (ESXi670-202503001.zip) 下载
VMware ESXi 6.7 U3v 是一款专为服务器虚拟化设计的裸机 Hypervisor,提供高效、可靠的硬件资源管理。它支持更高的硬件利用率、增强的安全性和简化的 IT 管理,帮助企业降低运营成本并提升性能。2025年3月4日发布的更新版本进一步提升了稳定性和兼容性。下载地址:<https://sysin.cn/blog/vmware-esxi-6/>,更多定制镜像和相关产品请访问 [sysin.org](https://sysin.org)。
5445 41
VMware ESXi 6.7 U3v (ESXi670-202503001.zip) 下载

热门文章

最新文章