模型介绍
中文整理FastInst快速实例分割模型介绍
模型描述
FastInst是一种简单的基于查询的图像分割框架。它的关键设计包括实例激活引导的查询、双路径更新策略和真值掩码引导的学习。这些组件使我们能够使用更轻量的像素解码器、更少的Transformer解码器层,同时获得更好的性能。 实验表明,FastInst在速度和准确性方面优于大多数最先进的实时实例分割模型,包括强大的全卷积网络基线。其结构示意图如下所示
以下是一些实验结果
期望模型使用方式以及适用范围
本模型适用范围较广,能对图片中包含的一般物体(COCO 80类)进行实例级别的分割。
如何使用
在ModelScope框架上,提供输入图片,即可通过简单的Pipeline调用来使用。
代码范例
模型局限性以及可能的偏差
部分非常规图片或感兴趣物体占比太小或遮挡严重可能会影响分割结果
当前版本在python 3.7环境测试通过,其他环境下可用性待测试
本模型依赖mmcv,需用户在机器上正确安装mmcv
训练数据介绍
COCO2017:COCO全称是Common Objects in Context,是Microsoft团队提供的一个可以用来图像识别、检测和分割的数据集。COCO2017包含训练集118287张、验证集5000张、测试集40670张,共有80类物体。
模型训练流程
请参考原论文
预处理
测试时主要的预处理如下:
Resize:先将原始图片的短边Resize到640,等比例缩放。此时如果长边超过了864,则按照最长边为864,重新计算Resize的scale进行Resize
Normalize:图像归一化,减均值除以标准差
Pad:图像高宽补零至32的倍数
数据评估及结果
模型在COCO2017val上进行测试,结果如下:
Backbone Pretrain Epochs mask mAP #params GFLOPs FPS (V100)
:--------: :-----------: :------: :--------: :-------: :------: :----------:
ResNet50 ImageNet-1k 50 37.9 34M 75.5 35.5
更多结果请参见原论文。
引用
如果你觉得该模型对你有所帮助,请考虑引用下面的相关论文:
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
