Ssylka

Технология INFP от bytedance оживляет портреты

Новая технология INFP, разработанная ByteDance, преобразует статические портретные фотографии в динамические, заставляя их «говорить» и реагировать на аудио. Модель анализирует нюансы человеческого поведения, включая мимику и повороты головы на основе видео, затем сопоставляет звуки с естественными движениями.
Технология INFP от bytedance оживляет портреты
Изображение носит иллюстративный характер

Инновация INFP заключается в ее способности различать роли «говорящего» и «слушающего» без дополнительной настройки. Система использует Motion-Based Head Imitation для анализа движений головы и Audio-guided motion generation для сопоставления звуков с естественными жестами. Специальный диффузионный трансформер обеспечивает плавность и естественность движений.

Разработчики внедрили коллекцию разговоров DyConv для обучения модели, что, по их утверждениям, позволило превзойти аналоги по точности сопоставления движений губ и сохранению индивидуальных черт лица. При этом создается широкий спектр естественных движений, делая оживленные портреты более реалистичными.

В планах ByteDance дальнейшее развитие INFP для объединения анимации с текстом, что позволит анимировать всё тело, расширяя творческие возможности. Несмотря на опасения некоторых пользователей относительно «жутковатого» эффекта от оживления фото, предварительные результаты показывают, что технология Bytedance достигла значительных успехов в естественности анимации.


Новое на сайте

19097Где можно будет наблюдать «затмение века» и ближайшие полные солнечные затмения? 19096Может ли высыхание озер ускорить раскол африканской тектонической плиты? 19095Возрождение Google Glass и новая эра AI Glasses: стратегия 2026 года и уроки прошлого 19094Телескоп Джеймс Уэбб раскрыл тайны происхождения жизни в туманности улитка 19093Загадка лунной иллюзии и нейробиологические причины искажения восприятия размера 19092Древние фракийцы почитали собачье мясо как ритуальный деликатес 19091О чем расскажет уникальный инструмент из кости слона возрастом 480 000 лет? 19090Спонтанное формирование личности искусственного интеллекта на основе потребностей и... 19089Почему появление миллиона гуманоидных роботов Optimus угрожает нашей способности понимать... 19088Почему наш мозг намеренно скрывает от нас собственный нос? 19087Почему CISA экстренно внесла критическую уязвимость VMware vCenter Server в каталог... 19086Почему наука окончательно отвергла ледниковую теорию перемещения камней Стоунхенджа? 19085Превращение легального IT-инструментария в бэкдор через фишинговую кампанию Greenvelope 19084CISA обновляет каталог KEV четырьмя критическими уязвимостями с директивой по устранению... 19083Как найденные в Бразилии древние гарпуны опровергли теорию о полярном происхождении...