GitHub-радар
SAM 3 от Meta: выдели объект в видео текстом
Facebook (Meta)выпустила SAM 3 — модель, которая находит, обводит и отслеживает любой объект в фото и видео по текстовому описанию или клику, и помещается на обычный ноутбук.
SAM 3 — единая модель Facebook (Meta)для выделения объектов в изображениях и видео. Она понимает текстовые запросы: опишите, что нужно выделить, и модель рисует точную маску. Работают и визуальные подсказки — точки, рамки, нарисованные маски — их можно сочетать с текстом. В видеорежиме модель отслеживает объект по кадрам без ручной разметки каждого кадра. На бенчмарке SA-CO, охватывающем 270 тысяч уникальных концептов, она достигает 75–80% от точности человека. Модель содержит 0.9B параметров и весит около 1.7 ГБ в полном формате.
Зачем это вайб-кодеру
Если вы работаете с фото или видеоконтентом, SAM 3 позволяет вырезать любой объект, просто описав его — без ручного обведения и покадровой работы. Для монтажёров, создателей контента и всех, кто строит визуальные цепочки с ИИ-агентом, это практичный локальный инструмент: достаточно компактный, чтобы запустить на любом ноутбуке.
Как поставить
Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:
Поставь мне SAM 3 от Meta: https://huggingface.co/facebook/sam3 — используй библиотеку transformers, загрузи модель и покажи, как выделить объект на моём фото по текстовому описанию.
Обычный ноутбук от 8 ГБ оперативки — модель весит около 1.7 ГБ в оригинальном формате.
Открыть на Hugging Face▌ Ещё находки