Ssylka

SAMURAI: эволюция zero-shot трекинга

Модель SAMURAI для визуального трекинга объектов представляет собой значительный шаг вперед по сравнению с предшествующими моделями SAM и SAM-2. SAM изначально предназначался для сегментации изображений на основе различных подсказок (текст, точки, bounding box, маски), а SAM-2 адаптировал эту архитектуру для видео, используя механизм памяти для отслеживания объектов во времени.
SAMURAI: эволюция zero-shot трекинга
Изображение носит иллюстративный характер

Основная инновация SAMURAI заключается в интеграции модели движения на основе фильтра Калмана, что значительно повышает точность отслеживания. Фильтр Калмана использует как предсказания модели, так и информацию о движении объекта, минимизируя влияние ошибок и неопределенности при отслеживании. Также введена система отбора кадров для памяти, которая отбрасывает кадры с плохим качеством.

SAMURAI использует оценку предсказанных масок с учетом их соответствия модели движения и уверенности в наличии объекта. Маска с наибольшим взвешенным скором на основе этих факторов выбирается для дальнейшего отслеживания. Усовершенствование памяти позволяет избегать накопления ошибок из-за хранения некачественных кадров, что было проблемой у SAM-2.

Благодаря этим улучшениям, SAMURAI демонстрирует высокую эффективность в задачах отслеживания объектов, особенно в сложных условиях с переполненными сценами, быстро движущимися объектами, и объектами, похожими друг на друга. Модель на основе фильтра Калмана и улучшенная память позволили достичь впечатляющих результатов в области zero-shot трекинга, что выводит ее на уровень конкурентоспособности с supervised-решениями.


Новое на сайте

19019Действительно ли «зомби-клетки» провоцируют самую распространенную форму эпилепсии и... 19018Генетический анализ мумий гепардов из саудовской Аравии открыл путь к возрождению... 19017Вредоносная кампания в Chrome перехватывает управление HR-системами и блокирует... 19016Глубоководные оползни раскрыли историю мегаземлетрясений зоны Каскадия за 7500 лет 19015Насколько глубоки ваши познания об эволюции и происхождении человека? 19014Как уязвимость CodeBreach в AWS CodeBuild могла привести к глобальной атаке через ошибку... 19013Затерянный фрагмент древней плиты пионер меняет карту сейсмических угроз Калифорнии 19012Генетические мутации вызывают слепоту менее чем в 30% случаев вопреки прежним прогнозам 19011Завершено строительство космического телескопа Nancy Grace Roman для поиска ста тысяч... 19010Вязкость пространства и фононы вакуума как разгадка аномалий расширения вселенной 19009Приведет ли массовое плодоношение дерева Риму к рекордному росту популяции какапо? 19008Как уязвимость CVE-2026-23550 в плагине Modular DS позволяет захватить управление сайтом? 19007Может ли уличная драка французского авантюриста раскрыть кризис американского гражданства... 19006Может ли один клик по легитимной ссылке заставить Microsoft Copilot и другие ИИ тайно... 19005Утрата истинного мастерства в эпоху алгоритмов и скрытые механизмы человеческого...