Ssylka

SAMURAI: эволюция zero-shot трекинга

Модель SAMURAI для визуального трекинга объектов представляет собой значительный шаг вперед по сравнению с предшествующими моделями SAM и SAM-2. SAM изначально предназначался для сегментации изображений на основе различных подсказок (текст, точки, bounding box, маски), а SAM-2 адаптировал эту архитектуру для видео, используя механизм памяти для отслеживания объектов во времени.
SAMURAI: эволюция zero-shot трекинга
Изображение носит иллюстративный характер

Основная инновация SAMURAI заключается в интеграции модели движения на основе фильтра Калмана, что значительно повышает точность отслеживания. Фильтр Калмана использует как предсказания модели, так и информацию о движении объекта, минимизируя влияние ошибок и неопределенности при отслеживании. Также введена система отбора кадров для памяти, которая отбрасывает кадры с плохим качеством.

SAMURAI использует оценку предсказанных масок с учетом их соответствия модели движения и уверенности в наличии объекта. Маска с наибольшим взвешенным скором на основе этих факторов выбирается для дальнейшего отслеживания. Усовершенствование памяти позволяет избегать накопления ошибок из-за хранения некачественных кадров, что было проблемой у SAM-2.

Благодаря этим улучшениям, SAMURAI демонстрирует высокую эффективность в задачах отслеживания объектов, особенно в сложных условиях с переполненными сценами, быстро движущимися объектами, и объектами, похожими друг на друга. Модель на основе фильтра Калмана и улучшенная память позволили достичь впечатляющих результатов в области zero-shot трекинга, что выводит ее на уровень конкурентоспособности с supervised-решениями.


Новое на сайте

7917Возрождение садов Уизли: великий обмен семенами как ключ к привлечению посетителей 7916Операция "Сердечный блок": как развалили империю фишинга на $3 миллиона 7915Останется ли Уэймут без кинотеатра? 7914Опасный свет: как ультрафиолет "обжигает" глаза и что с этим делать 7912Сравнение нейросетей: DeepSeek, Qwen и ChatGPT в задачах логики, визулизации и кодирования 7911Звезда "Эмили в Париже" Лили Коллинз и Чарли Макдауэлл стали родителями 7910Оптимизация запросов IN, EXISTS и JOIN в PostgreSQL 7909Лифтовая энергосистема: новая стратегия накопления 7908Альтернатива STM32: обзор микроконтроллеров Artery (AT32) 7907Отражения эпохи: бунт против иллюзорного мира 90-х 7906Интеллектуальные HR-ассистенты: эффективность и практическое применение 7905Почему северная Ирландия переживает столь масштабные последствия шторма "Эовин"? 7904Создание анимации песчаных частиц на WebGL: от прелоадера до шейдеров 7903Может ли Солнце осветить тень легенды: солнечные панели у могилы Робин Гуда