北大团队研发“车脸”识别系统,不看车牌看外观特征实现精确识别

简介: 北京大学信息科学技术学院田永鸿等三名研究人员研发了根据汽车外观特征,而非扫描车牌号来精确识别摄像头拍摄的车辆的新技术。研究人员称该项技术也能用于人脸识别和行人检测,能为侦破盗窃车辆等案件提供帮助。


image

北京大学信息科学技术学院田永鸿等三名研究人员研发了根据汽车外观特征,而非扫描车牌号来精确识别摄像头拍摄的车辆的新技术。研究人员称该项技术也能用于人脸识别和行人检测,能为侦破盗窃车辆等案件提供帮助。

论文:https://arxiv.org/pdf/1708.02386.pdf

据《参考消息》8月30日引西媒报道,北京大学信息科学技术学院田永鸿等三名研究人员研发了根据汽车外观特征精确识别摄像头拍摄的车辆的新技术。该系统不再依靠扫描车牌号,而是基于对车辆外观特征的记录和分析,如轮廓线条、碰撞损伤或漆面刮痕等,依据这些特征数据搜索出机动车的型号和注册信息。

研究人员将这一多任务学习框架命名为“Repression Network (RepNet)”,识别车辆依据的指标分为两类,一类是车辆外观的“一般细节”,如颜色、品牌、型号等;另一类是车辆的外观缺陷和损伤。

报道称,在当前阶段,还无法确定Repression Network系统将于何时投入应用,因为其应用可能会被认为侵犯了隐私权。但可以确定的是,如果利用该系统对视频监控系统记录的车辆影像进行识别,一定能为侦破盗窃车辆等案件提供帮助。

研究人员在论文中描述了根据汽车外观特征精确识别摄像头拍摄的车辆影像的新技术。他们表示,这种系统也能用于识别人脸特征。

研究人员称,公共安全系统监控摄像头的大规模使用,创造了一个庞大的图像和视频数据库,为车辆识别和搜索提供了重要的技术支持。虽然车牌是汽车的一个重要身份特征,但许多监控摄像头并非是为扫描车牌设计的,此外车牌识别系统在识别混淆字符时的表现非常糟糕,比如区分 8 和 B,O、D 或 0,因此他们提出这种以车辆外观特征数据为依据的精确识别系统。

论文:Learning a Repression Network for Precise Vehicle Search
作者:Qiantong Xu, Ke Yan, Yonghong Tian


image


摘要

在公共安全中监控摄像头使用的日益增多凸显了大型图像数据库对于车辆搜索(vehicle search)的重要性。精确车辆搜索(precise vehicle search)的目的是根据给定的需查询的车辆图片,搜索出所有实例。这是一项具有挑战性的任务,因为不同的汽车外形都非常相似。为了解决这个问题,我们提出一个新的多任务学习框架,名为 Repression Network (RepNet),用以同时从粗粒度和细粒度级别学习每张汽车图像的辨别特征。此外,从属性分类方法的高准确率得到启发,我们提出一种桶搜索(bucket search)方法,在减少检索时间的同时仍然保持竞争力。我们对经修改的VehcileID [1]数据集进行了广泛的实验,实验结果表明,我们的 RepNet 实现了 state-of-the-art 的性能,并且 bucket search 的方法将检索时间缩短了约24倍。


image


图1:具有PRL的RepNet中不同层的特征的显著性图(saliency map)。在显著性图中,亮度越高的区域表示原始图像中该区域的信息越多,嵌入到给定的特征向量中。上图第1列是查询图像(query image),第2列至第5列分别显示4个特征向量的显著性图:Fbase,Fmodel,Fcolor和FSLS-3。


image


图2:RepNet将三个一组的图像作为输入,并通过三个网络(包括卷积组,FC层和具有共享权重的Repression层(REP))进行馈送。输出特征的名称和大小列在每一层上方和下方。 Repression层采用两个特征向量FSLS-1和FACS作为输入。只有每个组中的 anchor image 被用于属性分类,即只有它的网络具有FC层和FACS之后的损失函数。


image


图3:具有PRL的RepNet中不同层的特征的显著性图和具有相同结构但有repression层的网络。第一列是query image,右边的两组4列分别是从两个网络分别学习四个特征向量(Fbase,Fmodel,Fcolor和FSLS-3)的显著性图。

实验结果


image

图4:不同模型的精度曲线。LS和BS是线性搜索(linear search)和桶搜索(bucket search)的缩写。

结论

在这篇论文中,我们提出了一个多任务学习框架,用于有效地生成属性分类和相似性学习的细粒度特征表示。Repression层被设计用于将从特征分类学习的信息嵌入到表示每辆车的特定细节特征中,并且还用于平衡两个FC层流的权重比例。通过向VehicleID数据集添加一个新属性,我们用修订后的数据集进行了广泛的实验,证明了我们的框架和repression层的有效性——linear search具有更高的图像检索精度,以及bucket search使检索时间更少。这些优点值得进一步调查RepNet学习细粒度特征表示,例如引入哈希函数来生成二进制特征或将卷积组分成两组。此外,我们的框架还可以推广到更广泛的应用,例如人脸识别和行人检索。

原文发布时间为:2017-08-31
编辑:刘小芹
本文来自云栖社区合作伙伴“新智元”,了解相关信息可以关注“新智元”微信公众号
原文链接

相关文章
|
机器学习/深度学习 自动驾驶 算法
道路表面缺陷数据集(裂缝/井盖/坑洼)(6000张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
随着城市化与交通运输业的快速发展,道路基础设施的健康状况直接关系到出行安全与城市运行效率。长期高强度的使用、气候变化以及施工质量差异,都会导致道路表面出现裂缝、坑洼、井盖下沉及修补不良等缺陷。这些问题不仅影响驾驶舒适度,还可能引发交通事故,增加道路养护成本。
道路表面缺陷数据集(裂缝/井盖/坑洼)(6000张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
|
10月前
|
传感器 运维 监控
基于北斗和蓝牙beacon的室内北斗定位系统从原理到应用全面详解(一)
本文介绍基于北斗与蓝牙beacon的室内定位系统,融合卫星与蓝牙技术优势,实现室内外无缝覆盖、多精度分级、低成本部署及多功能扩展,适用于工厂、园区等全域定位场景。
|
10月前
|
存储 网络协议 数据挖掘
阿里云通用算力型u2i实例与u1性能与适用场景对比,以及2核4G、4核8G活动价格参考
通用算力型实例是阿里云推出主打性价比的云服务器实例规格,这类实例首先有企业级实例,采用固定CPU调度模式。通用算力型u1实例推出时间比较久了,u2i实例刚推出不久,算力性能超u1实例40%,开发测试成本直降75%。目前u1实例2核4G5M带宽199元一年,且续费价格不变。而通用算力型实例u2i目前也已经正式开启首次优惠,指定配置2.5折1年。有的用户不清楚他们之间的区别,本文为大家介绍这二个通用算力型实例的性能、适用场景和活动价格的对比,以供选择参考。
955 3
阿里云通用算力型u2i实例与u1性能与适用场景对比,以及2核4G、4核8G活动价格参考
|
12月前
|
算法 数据可视化 异构计算
SparseGPT:大规模语言模型的一次性精确剪枝——论文解读
SparseGPT提出首个可高效剪枝百亿参数大模型的一次性精确方法,通过稀疏回归与近似求解器实现高稀疏度下仍保持精度,支持半结构化稀疏与量化联合压缩,显著降低推理成本。
1078 3
SparseGPT:大规模语言模型的一次性精确剪枝——论文解读
|
新零售 供应链 数据可视化
从销售到售后:汽车经销商如何用数据工具驱动门店管理?
随着汽车市场竞争加剧,新能源车崛起和新零售模式普及,传统汽车经销商门店运营面临盈利能力下降、售后客户流失及业务管理复杂等挑战。信息化工具如项目管理软件、DMS系统、CRM系统、数据分析工具和自动化营销工具,能通过数据整合、流程优化和智能化管理,帮助经销商实现精益运营,提升竞争力。
679 2
从销售到售后:汽车经销商如何用数据工具驱动门店管理?
|
机器学习/深度学习 编解码 计算机视觉
YOLOv11改进策略【注意力机制篇】| CVPR-2023 FSAS 基于频域的自注意力求解器 结合频域计算和卷积操作 降低噪声影响
YOLOv11改进策略【注意力机制篇】| CVPR-2023 FSAS 基于频域的自注意力求解器 结合频域计算和卷积操作 降低噪声影响
765 1
YOLOv11改进策略【注意力机制篇】| CVPR-2023 FSAS 基于频域的自注意力求解器 结合频域计算和卷积操作 降低噪声影响
|
算法 机器人 语音技术
由通义千问驱动的人形机器人具身智能Multi-Agent系统
申昊科技人形机器人小昊,集成通义千问多模态大模型的具身智能系统,旨在讲解销售、迎宾表演等场景。机器人通过语音、动作等方式与用户互动,利用云端大语言模型处理自然语言,结合视觉、听觉等多模态感知技术,实现流畅的人机对话、目标追踪、展厅讲解等功能。
2088 4
由通义千问驱动的人形机器人具身智能Multi-Agent系统
|
机器学习/深度学习 并行计算 计算机视觉
CUDA:王者之巅——探究CUDA为何能成为并行计算的佼佼者
本文探讨了CUDA在并行计算领域的崛起及其成为佼佼者的原因,详细介绍了CUDA的技术背景、架构原理及在深度学习、图像处理等领域的应用案例,展示了其显著的性能优势与优化方法,并展望了CUDA在未来计算技术发展中的潜力与方向。
|
机器学习/深度学习 人工智能 算法
探索机器学习中的过拟合现象及其解决方案
在机器学习领域,过拟合是一个常见且棘手的问题,它发生在模型过于复杂以至于捕捉到训练数据中的噪声而非信号时。本文将深入探讨过拟合的原因、影响以及如何通过技术手段有效缓解这一问题,旨在为读者提供一个全面而实用的指南。
|
存储 缓存 芯片