Ssylka

Технология INFP от bytedance оживляет портреты

Новая технология INFP, разработанная ByteDance, преобразует статические портретные фотографии в динамические, заставляя их «говорить» и реагировать на аудио. Модель анализирует нюансы человеческого поведения, включая мимику и повороты головы на основе видео, затем сопоставляет звуки с естественными движениями.
Технология INFP от bytedance оживляет портреты
Изображение носит иллюстративный характер

Инновация INFP заключается в ее способности различать роли «говорящего» и «слушающего» без дополнительной настройки. Система использует Motion-Based Head Imitation для анализа движений головы и Audio-guided motion generation для сопоставления звуков с естественными жестами. Специальный диффузионный трансформер обеспечивает плавность и естественность движений.

Разработчики внедрили коллекцию разговоров DyConv для обучения модели, что, по их утверждениям, позволило превзойти аналоги по точности сопоставления движений губ и сохранению индивидуальных черт лица. При этом создается широкий спектр естественных движений, делая оживленные портреты более реалистичными.

В планах ByteDance дальнейшее развитие INFP для объединения анимации с текстом, что позволит анимировать всё тело, расширяя творческие возможности. Несмотря на опасения некоторых пользователей относительно «жутковатого» эффекта от оживления фото, предварительные результаты показывают, что технология Bytedance достигла значительных успехов в естественности анимации.


Новое на сайте

18884Знаете ли вы, что приматы появились до вымирания динозавров, и готовы ли проверить свои... 18883Четыреста колец в туманности эмбрион раскрыли тридцатилетнюю тайну звездной эволюции 18882Телескоп Джеймс Уэбб раскрыл тайны сверхэффективной звездной фабрики стрелец B2 18881Математический анализ истинного количества сквозных отверстий в человеческом теле 18880Почему даже элитные суперраспознаватели проваливают тесты на выявление дипфейков без... 18879Шесть легендарных древних городов и столиц империй, местоположение которых до сих пор... 18878Обзор самых необычных медицинских диагнозов и клинических случаев 2025 года 18877Критическая уязвимость CVE-2025-14847 в MongoDB открывает удаленный доступ к памяти... 18876Научное обоснование классификации солнца как желтого карлика класса G2V 18875Как безграничная преданность горным гориллам привела Дайан Фосси к жестокой гибели? 18874Новый родственник спинозавра из Таиланда меняет представления об эволюции хищников Азии 18873Как новая электрохимическая технология позволяет удвоить добычу водорода и снизить... 18872Могут ли ледяные гиганты Уран и Нептун на самом деле оказаться каменными? 18871Внедрение вредоносного кода в расширение Trust Wallet привело к хищению 7 миллионов... 18870Проверка клинического мышления на основе редких медицинских случаев 2025 года