FastSAM(Fast Segment Anything Model)是一种基于深度学习的快速图像分割模型,旨在以极低的计算开销实现"分割一切"的能力。该模型以CNN架构为基础,能够对图像中的任意对象进行实例分割,支持点、框、文本等多种提示方式。相比原版SAM模型,FastSAM在推理速度上具有显著优势,适用于实时分割、自动标注及下游视觉任务等多种应用场景。
自动标注环节使用视觉语言模型(VLM)和FastSAM结合,构成'VLM定位+FastSAM精割'的自动标注流水线
FastSAM是Meta SAM模型的轻量化版本,能够在毫秒级时间内完成图像中任意目标的分割掩码生成