Ssylka

SAMURAI: эволюция zero-shot трекинга

Модель SAMURAI для визуального трекинга объектов представляет собой значительный шаг вперед по сравнению с предшествующими моделями SAM и SAM-2. SAM изначально предназначался для сегментации изображений на основе различных подсказок (текст, точки, bounding box, маски), а SAM-2 адаптировал эту архитектуру для видео, используя механизм памяти для отслеживания объектов во времени.
SAMURAI: эволюция zero-shot трекинга
Изображение носит иллюстративный характер

Основная инновация SAMURAI заключается в интеграции модели движения на основе фильтра Калмана, что значительно повышает точность отслеживания. Фильтр Калмана использует как предсказания модели, так и информацию о движении объекта, минимизируя влияние ошибок и неопределенности при отслеживании. Также введена система отбора кадров для памяти, которая отбрасывает кадры с плохим качеством.

SAMURAI использует оценку предсказанных масок с учетом их соответствия модели движения и уверенности в наличии объекта. Маска с наибольшим взвешенным скором на основе этих факторов выбирается для дальнейшего отслеживания. Усовершенствование памяти позволяет избегать накопления ошибок из-за хранения некачественных кадров, что было проблемой у SAM-2.

Благодаря этим улучшениям, SAMURAI демонстрирует высокую эффективность в задачах отслеживания объектов, особенно в сложных условиях с переполненными сценами, быстро движущимися объектами, и объектами, похожими друг на друга. Модель на основе фильтра Калмана и улучшенная память позволили достичь впечатляющих результатов в области zero-shot трекинга, что выводит ее на уровень конкурентоспособности с supervised-решениями.


Новое на сайте

18663Масштабная кампания ShadyPanda заразила миллионы браузеров через официальные обновления 18662Как помидорные бои и персонажи Pixar помогают лидерам превратить корпоративную культуру 18661Как астероид 2024 YR4 стал первой исторической проверкой системы планетарной защиты и... 18660Агентные ИИ-браузеры как троянский конь новой эры кибербезопасности 18659Многовековая история изучения приливов от античных гипотез до синтеза Исаака Ньютона 18658Как выглядела защита от солнца римских легионеров в Египте 1600 лет назад? 18657Хакеры ToddyCat обновили арсенал для тотального взлома Outlook и Microsoft 365 18656Асимметрия безопасности: почему многомиллионные вложения в инструменты детекции не... 18655Как безопасно использовать репозитории Chocolatey и Winget, не подвергая инфраструктуру... 18654Масштабная утечка конфиденциальных данных через популярные онлайн-форматеры кода 18653Как расширение списка жертв взлома Gainsight связано с запуском вымогателя ShinySp1d3r 18652Как расширение Crypto Copilot незаметно похищает средства пользователей Solana на... 18651Как обновление политик безопасности Microsoft Entra ID в 2026 году искоренит атаки 18650Архитектурная уязвимость Microsoft Teams позволяет хакерам отключать защиту Defender 18649Вторая волна червеобразной атаки Shai-Hulud прорвала защиту экосистем npm и Maven