点击下方卡片,关注“CVer”公众号
AI/CV重磅干货,第一时间送达
添加微信:CVer444,小助手会拉你进群!
扫描下方二维码,加入CVer学术星球,可以获得最新顶会/顶刊上的论文idea和CV从入门到精通资料,及最前沿应用!发论文搞科研,强烈推荐!

CVPR 2024 Workshop | 大规模视频分割比赛
The 3rd Pixel-level Video Understanding in the Wild Challenge Workshop


Workshop主页链接:
https://www.vspwdataset.com/Workshop2024.html
简介:像素级视频理解是计算机视觉领域的一个基本任务。目前学界对图片分割己经有了比较充分的研究。然而对与现实世界的很多应用,比如自动驾驶、短视频编辑等等,需要处理的多为视频数据。因此,对视频分割的研究是必要且具有现实意义的。为此,主办方采集了目前最大规模的复杂场景视频目标分割数据集Complex Video Object Segmentation (MOSE) [1]、基于动作描述的视频分割Motion Expression Video Segmentation (MeViS) [2]、视频语义分割数据集 Video Scene Parsing in the Wild (VSPW) [3] 、以及视频全景分割数据集VIdeo Panoptic Segmentation in the Wild (VIPSeg) [4],并在此基础上举办视频语义/全景/目标分割比赛。比赛公开了MOSE、MeViS、VSPW、以及VIPSeg 数据集的训练集和验证集,而测试集的ground truth 不会公开。参赛者可以提交测试集预测结果到比赛网站上来获得模型测试结果。
同时我们也欢迎不限于此次比赛的相关学术论文投稿,研究topic 包括但不限于视频/图片语义分割(VSS),视频目标分割(VOS),视频实例分割(VIS),视频全景分割(VPS),指向性视频目标分割(RVOS),指向性图像目标分割和检测(RES/REC),目标跟踪(Tracking)以及其他视频相关应用,投稿cmt地址为:
https://cmt3.research.microsoft.com/PVUW2024/
截稿日期详见workshop主页
https://www.vspwdataset.com/Workshop2024.html
本次比赛包含四个track:①视频语义分割(VSS Track),②视频全景分割(VPS Track),③复杂场景视频目标分割(MOSE Track),④基于动作描述的指向性视频分割(MeViS)。
① 视频语义分割赛道(VSS Track)
在此赛道中,参赛者可以使用VSPW的训练集来训练模型。其他相关的分割数据集(COCO、ADE20K 等)也可以应用在训练中,如果应用了其他数据集,需要向主办方说明使用额外数据集的信息。排行榜根据分割结果与ground truth 的mIoU来决定。
参赛网站:
https://codalab.lisn.upsaclay.fr/competitions/7869
数据集下载:
https://github.com/VSPW-dataset/VSPW-dataset-download
Baseline 代码:
https://github.com/VSPW-dataset/VSPW_baseline
② 视频全景分割赛道(VPS Track)
在此赛道中,参赛者可以使用VIPSeg的训练集来训练模型。其他相关的分割数据集(COCO、ADE20K 等)也可以应用在训练中,如果应用了其他数据集,需要向主办方说明使用额外数据集的信息。排行榜根据VPQ score来决定。
参赛网站:
https://codalab.lisn.upsaclay.fr/competitions/9743
数据集下载:
https://github.com/VIPSeg-Dataset/VIPSeg-Dataset
Baseline 代码:
https://github.com/VIPSeg-Dataset/VIPSeg-Dataset/tree/main/ClipPanoFCN
③ 复杂场景视频目标分割(MOSE Track)
在此赛道中,参赛者可以使用MOSE的训练集来训练模型。其他相关的分割数据集(COCO、ADE20K 等)也可以应用在训练中,如果应用了其他数据集,需要向主办方说明使用额外数据集的信息。排行榜根据分割结果与ground truth 的J&F来决定。
数据集主页:
https://henghuiding.github.io/MOSE/
参赛网站:
https://codalab.lisn.upsaclay.fr/competitions/10703
数据集下载:
https://codalab.lisn.upsaclay.fr/competitions/10703#participate
数据集api代码:
https://github.com/henghuiding/MOSE-api
④ 基于动作描述的指向性视频分割(MeViS)
在此赛道中,参赛者可以使用MeViS的训练集来训练模型。其他相关的分割数据集(RefCOCO、gRefCOCO等)也可以应用在训练中,如果应用了其他数据集,需要向主办方说明使用额外数据集的信息。排行榜根据分割结果与ground truth 的J&F来决定。
数据集主页:
https://henghuiding.github.io/MeViS/
参赛网站:
https://codalab.lisn.upsaclay.fr/competitions/15094
数据集下载:
https://codalab.lisn.upsaclay.fr/competitions/15094#participate
Baseline 代码:
https://github.com/henghuiding/MeViS
比赛分为两个阶段:第一阶段时间为2月1日至5月15日,参赛者可开发模型,提交测试集预测结果。本阶段返回部分测试集的预测结果。第二阶段为 5月15日至5月25日,是比赛的最终阶段。5月30日将公布最终比赛结果,并邀请4个比赛的冠军在6月17日下午的CVPR PVUW Workshop上汇报展示。
[1] MOSE: A New Dataset for Video Object Segmentation in Complex Scenes. ICCV 2023
[2] MeViS: A Large-scale Benchmark for Video Segmentation with Motion Expressions. ICCV 2023
[3] VSPW: A Large-scale Dataset for Video Scene Parsing in the Wild. CVPR 2021
[4] Large-scale Video Panoptic Segmentation in the Wild: A Benchmark. CVPR 2022
何恺明在MIT授课的课件PPT下载
在CVer公众号后台回复:何恺明,即可下载本课程的152页课件PPT!赶紧学起来!
CVPR 2024 论文和代码下载
在CVer公众号后台回复:CVPR2024,即可下载CVPR 2024论文和代码开源的论文合集
图像和视频分割交流群成立
扫描下方二维码,或者添加微信:CVer444,即可添加CVer小助手微信,便可申请加入CVer-图像和视频分割微信交流群。另外其他垂直方向已涵盖:目标检测、图像分割、目标跟踪、人脸检测&识别、OCR、姿态估计、超分辨率、SLAM、医疗影像、Re-ID、GAN、NAS、深度估计、自动驾驶、强化学习、车道线检测、模型剪枝&压缩、去噪、去雾、去雨、风格迁移、遥感图像、行为识别、视频理解、图像融合、图像检索、论文投稿&交流、PyTorch、TensorFlow和Transformer、NeRF等。
一定要备注:研究方向+地点+学校/公司+昵称(如图像或者视频分割+上海+上交+卡卡),根据格式备注,可更快被通过且邀请进群
▲扫码或加微信号: CVer444,进交流群
CVer计算机视觉(知识星球)来了!想要了解最新最快最好的CV/DL/AI论文速递、优质实战项目、AI行业前沿、从入门到精通学习教程等资料,欢迎扫描下方二维码,加入CVer计算机视觉(知识星球),已汇集近万人!
▲扫码加入星球学习
▲点击上方卡片,关注CVer公众号
整理不易,请点赞和在看


被折叠的 条评论
为什么被折叠?



