Re Reference AI

モデル

SAMとは

Segment Anything Model / Segment Anything

点やボックスの指示だけで画像内の任意の物体を切り出せる、Metaのセグメンテーション基盤モデル

画像認識Meta

ひとことで言うと

画像の中の「これ」と指した物体を、輪郭に沿ってきれいに切り出してくれるMetaのAIモデル。初めて見る物体でも切り出せる。

概要

SAM(Segment Anything Model)とは、Metaが公開した、画像内の任意の物体の領域を切り出すセグメンテーションの基盤モデルを指す。 点やボックスなどの簡単な指示(プロンプト)を与えるだけで、学習時に見ていない物体でもゼロショットで領域を切り出せる。 約11億のマスクを含む大規模データセットSA-1Bとともに公開され、画像セグメンテーションの汎用基盤として研究・産業の双方で広く使われている。後継のSAM 2では動画への対応が加わった。

歴史

2023年4月にMetaが論文とともに公開した。2024年7月には動画に対応したSAM 2が公開された。

関連用語

基盤モデルYOLOCLIPZero-shot

参考文献

関連Zenn記事