Ssylka

Технология INFP от bytedance оживляет портреты

Новая технология INFP, разработанная ByteDance, преобразует статические портретные фотографии в динамические, заставляя их «говорить» и реагировать на аудио. Модель анализирует нюансы человеческого поведения, включая мимику и повороты головы на основе видео, затем сопоставляет звуки с естественными движениями.
Технология INFP от bytedance оживляет портреты
Изображение носит иллюстративный характер

Инновация INFP заключается в ее способности различать роли «говорящего» и «слушающего» без дополнительной настройки. Система использует Motion-Based Head Imitation для анализа движений головы и Audio-guided motion generation для сопоставления звуков с естественными жестами. Специальный диффузионный трансформер обеспечивает плавность и естественность движений.

Разработчики внедрили коллекцию разговоров DyConv для обучения модели, что, по их утверждениям, позволило превзойти аналоги по точности сопоставления движений губ и сохранению индивидуальных черт лица. При этом создается широкий спектр естественных движений, делая оживленные портреты более реалистичными.

В планах ByteDance дальнейшее развитие INFP для объединения анимации с текстом, что позволит анимировать всё тело, расширяя творческие возможности. Несмотря на опасения некоторых пользователей относительно «жутковатого» эффекта от оживления фото, предварительные результаты показывают, что технология Bytedance достигла значительных успехов в естественности анимации.


Новое на сайте

19074Критическая уязвимость в Fortinet позволяет хакерам автоматизированно захватывать... 19073Обнаружение древнего святилища геркулеса и элитного погребального комплекса в пригороде... 19072Уникальный случай появления койота на острове алькатрас после изнурительного заплыва... 19071Уникальное искусственное затмение миссии Proba-3 раскрыло редкие солнечные феномены 19070Колоссальный запас древней пресной воды найден под дном атлантического океана 19069Обнаружение челюсти в Эфиопии доказывает сосуществование трех родов гоминидов и расширяет... 19068Память как инструмент правосудия и примирения в постдиктаторском Чили 19067Насколько опасны новые критические уязвимости в Zoom и GitLab? 19066Как умные MSSP используют ИИ для увеличения маржи с половиной штата в реалиях 2026 года? 19065Может ли общение с чат-ботом GPT-4o привести к психозу и вере в цифровое воскрешение? 19064Почему традиционные методы управления уязвимостями уступают место платформам оценки... 19063Почему критические уязвимости в Chainlit и Microsoft MCP открывают хакерам полный доступ... 19062Возможно ли написать 88 000 строк вредоносного кода VoidLink в одиночку за несколько дней? 19061Чем грозит разработчикам критическая уязвимость CVE-2026-1245 в библиотеке binary-parser? 19060Новая фишинговая кампания против пользователей LastPass нацелена на кражу мастер-паролей