比男友更了解你的穿搭喜好,这个模型可以陪你挑衣服 | 论文

简介:
本文来自AI新媒体量子位(QbitAI)

购物网站总想通过推荐系统让你多买几件衣服。

但穿搭可是个不太好把控的东西,复杂的服装风格不仅让人挑得眼花缭乱,推荐系统也无法准确推荐出你想买的。最近一项研究表示,有个模型能准确判断衣服的风格,推荐最有可能被购买的服装。

这项成果来自首尔国立大学计算机科学与工程学系的Hanbit Lee、Jinseok Seol和Sang-goo Lee三人。本周一,他们在arXiv上发表了题为《Style2Vec: Representation Learning for Fashion Items from Style Sets》的论文。

量子位挑选精彩的部分编译整理,与大家分享这个比男友更了解你穿搭喜好的模型。

论文摘要

随着在线时尚产业的发展,我们对潮流推荐系统的需求越来越大且要求越来越高。对于推荐系统来说,找到用户喜欢的风格比根据购买记录推荐相似衣服重要得多。

只知道用户一个月中购买了礼服和工装裤还不能做些什么,因为我们不知道这些服装具有什么特征。如果能用一种可行的方式表示时装的风格特征,并将它们整理成连贯的风格集,将能向用户准确推荐他喜欢的衣服。

在这里,我们引入了一种服装向量表示模型,并将它命名为Style2Vec。基于词嵌入中使用的直观分布式语义,Style2Vec通过对照数据集中的穿衣搭配了解时尚的表现形式。

为了准确评估,我们用类比测试评估各种与时尚相关的语义,如形状、颜色、图案甚至是潜在的样式。最后,用Style2Vec将衣物风格分类,结果显示,它能胜任时装相关的分类任务。

数据集

Polyvore是一个服装在线搭配的网站,搜罗了几百万件网店的流行单品,用户可以根据自己的喜好将服装图片自行组合查看穿搭效果。

 图片来自Polyvore

研究人员在Polyvore上选取了将近30万套流行服装的搭配,总共包含53460件上装、43180件下装、31199件外塔、77981双鞋子和30852件连衣裙,总共23万多件不重复的单品,每一套搭配中含有2到4样。

获取了这么多服装搭配的样例后,研究人员用一个16层的VGGNet结构将图片映射成1024维的向量。

整个网络用小批量梯度下降法(Mini-batch Gradient Descent,MBGD)通过batch normalization的Adam优化器进行训练。

风格化样式空间

之后,研究人员用t-SNE算法将1024维的服装特征嵌入2D空间。

 可视化样式空间

从上图可以看到,算法做的不错。左上角是划分出的正装区,包含一些西服、礼裙与高跟鞋;左下是朋克区,汇集了张扬的摇滚元素与朋克范;右上是休闲区,带着满满的居家与舒适感;紧挨着休闲区的右下部分是被分出的运动鞋与休闲鞋。

这个风格化的样式空间证明了模型可以比较准确地将图像转换到合理的样式空间中。

类比测试

为了研究这些潜在风格特征的内在特征,研究人员进行了潮流类比测试。测试题很有意思,也很固定——如果x对应y,那么z对应着?

比如这个问题:“如果朋克靴对应夹克,那么高跟鞋对应什么?”研究人员想用这种形式测试是否存在一些潜在的与风格有关的规则。下面这张图是模型匹配的结果——

我们可以看到,模型类比推理显示出很多隐藏的规则。(a)表示了颜色和样式的转移,即粉色短裙-黑色短裙和黑色夹克-粉色夹克之间的匹配;(b)案例与(a)类似,是格子裤-黑裤与黑裙-格子裙之间的转换;(c)(d)是风格的转换,即朋克上衣-休闲上衣与朋克裤-休闲裤的匹配;(e)与(f)显示出正装与休闲装的转换。

通过这项对比实验,我们可以看出模型的特征向量具有颜色、图案、形状等基本特征以及潜在的分类特征。

能够判断出你喜爱哪一类风格的服饰,知道这些风格含有哪些时尚元素——看来,这个模型有能力做你的穿搭助手,有潜力被应用在网店的推荐系统中。

而你,离剁手又进了一步。

最后,附论文地址:

https://arxiv.org/pdf/1708.04014v1.pdf

本文作者:安妮 
原文发布时间:2017-08-16
相关文章
|
2月前
|
Web App开发 缓存 安全
Quick BI使用案例25:重启电脑打开Chrome浏览器登录后,不到30分钟提示“未登录,当前请求被禁止”
本文详解Chrome浏览器因本地数据保存策略导致Quick BI登录30分钟内自动退出的成因,并提供两种可选的浏览器设置方案,助您稳定登录、释放产品价值。
|
2月前
|
人工智能 自然语言处理 API
用 Token Plan 低成本接入 Qwen3.7,我是怎么把 AI 成本压到 4.5 折的
阿里云百炼Token Plan以统一Credits支持Qwen3.7-Max/Plus等15款主流模型灵活切换,兼顾高性能与低成本;内置RAG、Prompt调试与应用发布能力,小团队可零基建快速落地知识库问答系统。
|
人工智能 自然语言处理 知识图谱
Yuxi-Know:开源智能问答系统,基于大模型RAG与知识图谱技术快速构建知识库
Yuxi-Know是一个结合大模型RAG知识库与知识图谱技术的智能问答平台,支持多格式文档处理和复杂知识关系查询,具备多模型适配和智能体拓展能力。
4245 55
Yuxi-Know:开源智能问答系统,基于大模型RAG与知识图谱技术快速构建知识库
|
JSON 前端开发 JavaScript
惊艳!阿里开源 15.2k Star 企业级低代码引擎揭秘,如何变革前端开发方式?
阿里巴巴开源的 LowCodeEngine 是一款企业级低代码引擎,具备可视化编排、UI 渲染、代码生成等全链路能力。支持 React、Vue、Rax 等框架,提供高扩展性与类型安全,助力高效开发,降低维护成本,适用于后台系统、多端同步等场景。
1846 1
|
6月前
|
人工智能 自然语言处理 供应链
智能客服系统对企业的应用价值:人机协同重构企业服务体系(2026年2月最新)
截至2026年,全球智能客服市场规模达587亿美元(CAGR 24.3%),中国82%企业推行人机协同,金融/电商/电信覆盖率超85%。AI承担68%常规咨询,坐席响应提速42%,客户满意度达85.7分,成本降41%。瓴羊Quick Service以多模态理解、情绪识别、实时协陪等能力,助力企业实现服务即洞察、服务即增长。(239字)
|
7月前
|
存储 人工智能 自然语言处理
炎鹊:Nexus Agent v1.0架构下的专属AI模型大脑的技术实现路径
炎鹊AI推出「LLM+AIGA决策大脑+知识图谱+业务模型」四层架构,通过Nexus Agent引擎实现垂直场景深度适配。融合领域蒸馏、LoRA微调、任务闭环与低代码建模,提升行业AI准确率30%-50%,开发周期缩至2-4周,成本降60%以上,支持私有化部署与合规安全,助力企业高效构建专属AI大脑。(238字)
439 2
|
测试技术 开发工具 git
写了BUG还想跑——闲鱼异常日志问题自动追踪-定位-分发机制
为了高效地发现、定位和解决预发问题,闲鱼团队研发了一套异常日志问题自动追踪-定位-分发机制。这套机制通过自动化手段,实现了异常日志的定时扫描、精准定位和自动分发,显著降低了开发和测试的成本,提高了问题解决的效率。
754 15
写了BUG还想跑——闲鱼异常日志问题自动追踪-定位-分发机制
|
机器学习/深度学习 数据可视化 数据处理
构建可靠的时间序列预测模型:数据泄露检测、前瞻性偏差消除与因果关系验证
在时间序列分析中,数据泄露、前瞻性偏差和因果关系违反是三大常见且严重影响模型有效性的技术挑战。数据泄露指预测模型错误使用了未来信息,导致训练时表现优异但实际性能差;前瞻性偏差则是因获取未来数据而产生的系统性误差;因果关系违反则可能导致虚假相关性和误导性结论。通过严格的时序数据分割、特征工程规范化及因果分析方法(如格兰杰因果检验),可以有效防范这些问题,确保模型的可靠性和实用性。示例分析展示了日本天然气价格数据中的具体影响及防范措施。 [深入阅读](https://avoid.overfit.cn/post/122b36fdb8cb402f95cc5b6f2a22f105)
1082 24
构建可靠的时间序列预测模型:数据泄露检测、前瞻性偏差消除与因果关系验证
|
数据采集 Web App开发 监控
捕获抖音截图:如何用Puppeteer保存页面状态
随着抖音直播的兴起,实时动态和互动元素吸引了大量用户。为了捕获直播页面的实时信息,本文介绍了如何使用 Puppeteer 和代理 IP 服务,解决页面动态加载、反爬虫机制等问题,实现自动化抓取和截图保存。通过安装 Puppeteer、配置代理 IP 和编写简单脚本,可以高效地捕获抖音直播页面的状态。
935 51
|
人工智能 数据可视化 程序员
精心整理自学python的宝藏网站,不看亏死
精心整理自学python的宝藏网站,不看亏死
2045 4
精心整理自学python的宝藏网站,不看亏死