7 Papers & Radios | ECCV 2022最佳论文;Transformer在试错中自主改进

简介: 7 Papers & Radios | ECCV 2022最佳论文;Transformer在试错中自主改进

参与:杜伟、楚航、罗若天

本周重要论文包括 ECCV 2022各奖项论文以及 DeepMind 的算法蒸馏新研究。


目录:

  1. In-context Reinforcement Learning with Algorithm Distillation
  2. Petabit-per-second data transmission using a chip-scale microcomb ring resonator source
  3. DetCLIP: Dictionary-Enriched Visual-Concept Paralleled Pre-training for Open-world Detection
  4. A Level Set Theory for Neural Implicit Evolution under Explicit Flows
  5. Pose-NDF: Modelling Human Pose Manifolds with Neural Distance Fields
  6. On the Versatile Uses of Partial Distance Correlation in Deep Learning
  7. UNIF: United Neural Implicit Functions for Clothed Human Reconstruction and Animation
  8. ArXiv Weekly Radiostation:NLP、CV、ML 更多精选论文(附音频)


论文 1:In-context Reinforcement Learning with Algorithm Distillation


摘要:在近日 DeepMind 的一篇论文中,研究者假设 PD 没能通过试错得到改进的原因是它训练用的数据无法显示学习进度。当前方法要么从不含学习的数据中学习策略(例如通过蒸馏固定专家策略),要么从包含学习的数据中学习策略(例如 RL 智能体的重放缓冲区),但后者的上下文大小(太小)无法捕获策略改进。

研究者提出了算法蒸馏(Algorithm Distillation, AD),这是一种通过优化 RL 算法学习历史中因果序列预测损失来学习上下文策略改进算子的方法。如下图 1 所示,AD 由两部分组成。首先通过保存 RL 算法在大量单独任务上的训练历史来生成大型多任务数据集,然后 transformer 模型通过将前面的学习历史用作其上下文来对动作进行因果建模。由于策略在源 RL 算法的训练过程中持续改进,因此 AD 不得不学习改进算子以便准确地建模训练历史中任何给定点的动作。至关重要的一点是,transformer 上下文必须足够大(即 across-episodic)才能捕获训练数据的改进。

推荐:DeepMind 新作:无需权重更新、提示和微调,transformer 在试错中自主改进。

论文 2:Petabit-per-second data transmission using a chip-scale microcomb ring resonator source


摘要:近日,来自丹麦技术大学(DTU)和瑞典哥德堡查尔姆斯理工大学的研究小组实现了迄今为止最高的数据传输效率,并且是世界上第一个仅使用单个激光器和单个光芯片实现每秒传输超过 1 拍比特 (Pbit/s) 的研究。

在实验中,研究人员仅使用一个光源在 7.9 公里的距离上实现了传输速率 1.8 Pbit/s——1 Petabit 相当于 12.5 万 Gigabyte,根据一些估算,全世界使用的平均互联网带宽约为 1 Pbit/s,因此它的速度接近全球带宽的两倍。

通信系统建模。

推荐:1.84Pb/s,两倍于全球互联网带宽总和:单激光器实现最快数据传输纪录。

论文 3:DetCLIP: Dictionary-Enriched Visual-Concept Paralleled Pre-training for Open-world Detection


摘要:开放域检测问题是指在上游利用大量网上爬取的图文对或一定类别的人工标注数据进行训练,如何在下游场景上实现任意类别检测的问题。开放域检测方法在产业界的应用主要包括自动驾驶系统路面物体检测,云端全场景检测等。

本论文对开放域检测问题提出了一种针对多数据源联合高效的并行训练框架,同时构建了额外的知识库来提供类别间的隐式关系。同时 DetCLIP 在微软举办的 ECCV2022 OdinW (Object Detection in the Wild[1]) 比赛上以 24.9% 的平均检测指标取得了 zero-shot 检测赛道第一名。论文已被 NeurIPS 2022 接收。

推荐:NeurIPS 2022 | 开放域检测新方法 DetCLIP,推理效率提升 20 倍。

论文 4:A Level Set Theory for Neural Implicit Evolution under Explicit Flows


摘要:基于坐标的神经网络参数化隐式表面已经成为几何的有效表示,它们高效充当了参数水平集,其中零水平集定义了感兴趣的表面。研究者提出了一个框架,允许将为三角形网格定义的变形操作应用于这类表面。这些操作中的一些可以被视为在显式表面引起瞬时流场的能量最小化问题。他们的方法通过扩展水平集的经典理论,利用流场来实现参数化隐式表面变形。

此外,通过形式化与水平集理论的关联,研究者还为现有的可微表面提取和渲染方法得出一个统一的观点。他们认为这些方法偏离了理论,并展示了自身方法对表面平滑、平均曲率流、逆渲染和用户定义的隐式几何编辑等应用的改进。

推荐:ECCV 2022 最佳论文荣誉提名奖。

论文 5:Pose-NDF: Modelling Human Pose Manifolds with Neural Distance Fields


摘要:本文提出了一种基于神经距离场 (NDFs) 的人体姿态连续模型:Pose-NDF。众所周知,姿态或动作先验对于生成逼真的新姿态非常重要,对从有噪声或局部观察重建精确的姿态也非常重要。
Pose-NDF 学习一系列各种可能的姿态作为神经隐式函数的零水平集(zero level set),将 3D 建模隐式曲面的思想扩展到高维域 SO(3)^K,其中人体姿态由单个数据点定义,由 K 个四元数表示。由此得到的高维隐函数可以对输入姿态进行微分,因此可以通过在 3 维超球体集合上使用梯度下降将任意姿态投射到流形(manifold)上。

推荐:ECCV 2022 最佳论文荣誉提名奖。

论文 6:On the Versatile Uses of Partial Distance Correlation in Deep Learning


摘要:比较神经网络模型的功能行为,无论是在训练期间的单个网络,还是训练一段时间后的两个网络(或更多网络),这些是了解模型正在学习什么(以及它们没有学习什么)的重要步骤,同时也是确定规范化或提高效率的重要策略。最近的研究已经取得了一些进展,例如研究者将视觉 transformers 与 CNN 进行比较,但系统地比较功能,特别是在不同的网络之间,仍然存在很多困难,通常的做法是一层一层地进行比较。

CCA(canonical correlation analysis)等方法在原则上适用,但迄今为止用的人很少。本文回顾了统计学中一个鲜为人知的概念,称为距离相关(及其部分变体),它被设计用来评估不同维度特征空间之间的相关性。该研究描述了将其部署到大规模模型的必要步骤,这为一系列应用打开了大门,包括调节一个深度模型,学习解耦表示,以及优化不同的模型,这些模型在应对对抗攻击时,鲁棒性更好。

推荐:ECCV 2022 最佳论文。

论文 7:UNIF: United Neural Implicit Functions for Clothed Human Reconstruction and Animation


摘要:上海科技大学和 ZMO.AI 的研究者提出了一套分部件人体重建和驱动的方法 UNIF,借助简洁有效的初始化和正则化手段,使分部件重建方法摆脱对部件划分标签的依赖。通过显式地建模部件之间的相互作用,显著提升了分部件重建方法对人体姿态的泛化能力。ZMO.AI 是国内头部内容生成初创公司,专注于 AI 文字生成内容 Yuan 初 创作平台的搭建。该论文已被 ECCV 2022 接收,并公开了代码。

推荐:ECCV 2022 | 摆脱部件标签依赖,上科大 & ZMO.AI 提出分部件 3D 人体重建与驱动新方法 UNIF。
ArXiv Weekly Radiostation

相关文章
|
存储 NoSQL Java
什么是Cookie与Session之Session详解
什么是Cookie与Session之Session详解
1469 0
|
5月前
|
SQL 关系型数据库 MySQL
Quick BI使用案例13:自动识别月末收官日,实现收官日区域订单数量精准统计
本文详解如何精准提取各销售战区每月最后一天的订单量,助力分析冲刺能力、绩效考核与库存节奏,提升数据驱动决策效率。
|
2月前
|
人工智能 测试技术 API
GLM 5.2深度实战:API快速集成、MIT权重配置与百万上下文能力验证
GLM 5.2是智谱AI于2026年6月推出的旗舰级大模型,凭借744B总参数MoE混合专家架构、原生支持100万Token稳定上下文窗口,以及MIT许可开源权重,成为当前开源模型领域的标杆产品。该模型不仅在长程编程、文档分析等任务中表现突出,还提供了Z.ai Coding Plan托管API与MIT开源权重两种接入路径,满足个人开发者、企业团队的不同使用需求。本文将从API快速接入、MIT开源权重本地部署、百万上下文能力实测三大核心环节,提供完整实战指南,帮助开发者高效落地GLM 5.2。
742 1
|
4月前
|
存储 安全 算法
【分布式】分布式一致性协议:2PC/3PC、Paxos、Raft、ZAB 核心原理、区别(2026必考Raft)
本文系统梳理分布式一致性核心理论与四大协议(2PC/3PC、Paxos、Raft、ZAB),聚焦原理、差异及工程实践。重点强化2026年必考的Raft协议——涵盖Leader选举、日志复制、安全性机制、快照与成员变更等核心考点,构建完整、可落地的知识体系。
|
4月前
|
弹性计算 安全 Linux
零基础实战:阿里云ECS云服务器OpenClaw(Clawdbot)部署+本地系统搭建+大模型API对接指南
2026年,OpenClaw(原Clawdbot)作为轻量化开源AI代理框架,凭借跨平台兼容、大模型无缝集成、多场景自动化能力,成为个人与小型团队搭建智能助手的首选方案。本文完整覆盖2026年阿里云轻量服务器部署及本地MacOS/Linux/Windows11部署OpenClaw(Clawdbot)步骤流程及阿里云千问大模型API配置或市场上免费大模型Coding Plan API配置及常见问题解答,以阿里云ECS云服务器为核心部署方案,同步补充本地全平台搭建方法,所有代码命令可直接复制,全程无复杂操作,新手也能一次成功落地。
717 1
|
7月前
|
数据可视化 安全 BI
PageAdmin CMS 可视化智能表单与业务系统搭建完全指南
“无需代码,拖拽即用!PageAdmin CMS可视化智能表单系统让企业零基础搭建专业级管理系统,26种组件+智能工作流,从数据收集到BI分析一站式实现业务数字化。”
289 5
|
9月前
|
关系型数据库 Serverless 分布式数据库
阿里云PolarDB云原生数据库计费类型:Serverless详细说明
阿里云PolarDB Serverless计费模式支持秒级弹性扩缩容,按需使用CPU、内存资源,自动增减只读节点,实现成本优化。以PCU为单位,最小粒度0.5 PCU,按秒计费,结合计算包更省钱。适用于流量波动业务,详情见官网。
352 4
|
8月前
|
消息中间件 存储 监控
实时数据有哪些特点?企业该如何管理好实时数据?
企业正从“事后看”转向“实时看”数据,实时数据要求秒级甚至毫秒级响应,具备持续流入、价值衰减快、流量突增等特点。管理好它需构建四大能力:流式处理架构、全链路监控、分层服务与业务闭环。建议从痛点场景试点,逐步打造可复用的实时数据体系。
|
运维 Linux 虚拟化
VMware虚拟机安装教程,Windows下安装VMware虚拟机,附VMware下载,Windows各版本系统镜像下载
虚拟机技术允许一台物理机运行多个操作系统,提升资源利用率,节省成本。通过快照、克隆等功能,实现系统快速恢复与复制,提高运维效率。本文详细介绍VMware虚拟机的安装步骤、Windows镜像下载及系统安装激活流程,适合初学者快速入门。
13221 0
|
缓存 算法 数据挖掘
深入理解缓存更新策略:从LRU到LFU
【10月更文挑战第7天】 在本文中,我们将探讨计算机系统中缓存机制的核心——缓存更新策略。缓存是提高数据检索速度的关键技术之一,无论是在硬件还是软件层面都扮演着重要角色。我们会详细介绍最常用的两种缓存算法:最近最少使用(LRU)和最少使用频率(LFU),并讨论它们的优缺点及适用场景。通过对比分析,旨在帮助读者更好地理解如何选择和实现适合自己需求的缓存策略,从而优化系统性能。
789 3