前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >UniMatch项目原作解读:统一光流、立体匹配和深度估计三个任务

UniMatch项目原作解读:统一光流、立体匹配和深度估计三个任务

作者头像
机器之心
发布2023-03-29 14:52:10
3240
发布2023-03-29 14:52:10
举报
文章被收录于专栏:机器之心

从二维图像中理解场景的三维结构和运动信息是计算机视觉领域的一项核心研究目标,也是许多实际应用的基石。近年来,许多不同的网络结构被提出来解决几何和运动相关的任务,如深度估计、立体匹配和光流等。然而,现有的工作大多致力于设计特定的网络结构来独立解决每一个特定的任务,忽视了许多几何和运动估计任务是本质上相关的对应关系估计问题。这种针对特定任务的研究理念不可避免地导致需要处理大量的网络结构。此外,独立地研究每一项特定的任务使得无法很好地复用预训练的模型,因为各任务之间的网络结构和模型参数往往有所差异。

机器之心最新一期线上分享邀请到了苏黎世联邦理工学院与图宾根大学联合培养博士生徐豪飞,为大家解读他们CVPR 2022的Oral论文 GMFlow 及其后续工作UniMatch。

这项工作提出了一个统一模型 UniMatch 来解决三个稠密感知任务:光流、立体匹配和深度估计。作者的主要观察在于这三个任务可以通过一种显式地稠密特征匹配框架来进行统一,进而这一问题被转化为提取任务无关的、判别能力强的特征来进行匹配。为此,文章提出采用 Transformer,尤其是 cross-attention 来实现。其中 cross-attention 可以建模两张图片之间的相互依赖关系,从而极大地提升特征的质量。由于网络结构和参数在不同任务之间是共享的,因此可以很自然地支持跨任务之间的迁移。文章提出的最终模型在10个流行的数据集上取得了最好或具有竞争力的结果,同时网络结构更加简单和高效。

分享主题:UniMatch: 统一光流、立体匹配和深度估计三个任务

分享嘉宾:徐豪飞,苏黎世联邦理工学院与图宾根大学联合培养博士生。硕士毕业于中国科学技术大学。研究方向包括光流、立体匹配和三维场景表征学习。

分享摘要:本次分享将首先介绍相关领域的发展历程,进而介绍我们 CVPR 2022的Oral论文 GMFlow 及其后续工作UniMatch:统一光流、立体匹配和深度估计三个任务,并展示该统一模型的独特性与优势,最后会讨论该工作的局限性及可能的未来研究方向。

相关链接:

1)SOTA!模型平台项目主页链接:

https://sota.jiqizhixin.com/project/unimatch

2)项目主页:

https://haofeixu.github.io/unimatch/

3)论文链接:

https://arxiv.org/abs/2211.05783v1

4)代码仓库:

https://github.com/autonomousvision/unimatch

加群看直播

直播间:关注机器之心机动组视频号,北京时间 12 月 28 日 19:00 开播。

交流群:本次直播设有 QA 环节,欢迎加入本次直播交流群探讨交流。

如群已超出人数限制,请添加机器之心小助手:syncedai2、syncedai3、syncedai4 或 syncedai5,备注「UniMatch」即可加入。

如果你也有最新工作希望分享或提交你感兴趣的内容方向,随时告诉我们吧:https://jiqizhixin.mikecrm.com/fFruVd3

机器之心 · 机动组

机动组是机器之心发起的人工智能技术社区,聚焦于学术研究与技术实践主题内容,为社区用户带来技术线上公开课、学术分享、技术实践、走近顶尖实验室等系列内容。机动组也将不定期举办线下学术交流会与组织人才服务、产业技术对接等活动,欢迎所有 AI 领域技术从业者加入。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2022-12-26,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 机器之心 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
相关产品与服务
云直播
云直播(Cloud Streaming Services,CSS)为您提供极速、稳定、专业的云端直播处理服务,根据业务的不同直播场景需求,云直播提供了标准直播、快直播、云导播台三种服务,分别针对大规模实时观看、超低延时直播、便捷云端导播的场景,配合腾讯云视立方·直播 SDK,为您提供一站式的音视频直播解决方案。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档