CVPR 2024 | 字节提出新一代数据集COCONut，比COCO粒度分割更密集

AIGC动态2年前 (2024)发布机器之心

AIGC动态欢迎阅读

原标题：CVPR 2024 | 字节提出新一代数据集COCONut，比COCO粒度分割更密集
关键字：字节跳动,数据,模型,语义,全景
文章来源：机器之心
内容字数：3726字

内容摘要：

AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年，机器之心AIxiv专栏接收报道了2000多篇内容，覆盖全球各大高校与企业的顶级实验室，有效促进了学术交流与传播。如果您有优秀的工作想要分享，欢迎投稿或者联系报道。投稿邮箱：liyazhou@jiqizhixin.com；zhaoyunfeng@jiqizhixin.com。随着人工智能的发展，语言模型和生成模型获得了大量的成功并且在设计模型的过程中，模型的参数量也越来越大。对于细粒度理解任务，模型参数量也同样在增加。然而目前现有的数据集存在规模和精度的矛盾，例如 SA-1B 数据集中 99.1% 的 mask 都是机器生成的，但没有赋予语义的标签，而其他一些公开数据集也同样存在精度问题并且这些数据集的规模一般都比较小。
近期，字节跳动提出了新一代细粒度理解的数据集，针对当代深度学习模型的设计需求，给总量为 383K 的图片进行了全景分割的人工标注，最后达到了 5.18M 张 mask，是至今最大规模的带人工标签的全景分割理解数据集，命名为 COCONut。该成果已入选 CVPR2024。论文链接：https://arxiv.o

原文链接：CVPR 2024 | 字节提出新一代数据集COCONut，比COCO粒度分割更密集