Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки

Ученые из Миланского политехнического университета (Politecnico di Milano) Асаф Али Шахид и Лорис Роведа разработали искусственный интеллект для симулированного гуманоидного робота, названного "Robot Drummer". Проект, идея которого возникла спонтанно за чашкой кофе, был нацелен на исследование возможностей роботов в творческих и экспрессивных сферах, таких как музыка, требующих сложной координации, ритма и физического исполнения.
Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки
Изображение носит иллюстративный характер

В основе системы лежит технология обучения с подкреплением (Reinforcement Learning, RL). В рамках этого метода искусственный интеллект, или «агент», обучается путем проб и ошибок. Взаимодействуя с окружением, в данном случае с виртуальной барабанной установкой, система получает математическое «вознаграждение» за правильные действия и «наказывается» за неверные. Конечная цель — найти оптимальную политику действий для максимизации вознаграждения.

Для симуляции использовалась модель гуманоидного робота G1 Unitree. Каждая песня представлялась для ИИ в виде цепочки точно рассчитанных по времени «событий контакта». Эти инструкции указывали роботу, по какому барабану и в какой именно момент необходимо нанести удар. Такой подход позволил системе обрабатывать сложные музыкальные партитуры.

В процессе обучения искусственный интеллект самостоятельно разработал продвинутые барабанные техники. Среди них — использование перекрестных ударов руками (cross-arm strikes) и адаптивное назначение палочек, при котором система сама решала, какой рукой эффективнее нанести тот или иной удар для достижения нужного звучания.

Демонстрация работы системы была опубликована на YouTube. В видеоролике трехмерная визуализация робота G1 играет на барабанной установке с цветовой кодировкой. Система была протестирована на более чем 30 популярных композициях в жанрах поп, рок, метал и джаз.

Исполнение песни "In the end" группы Linkin Park было охарактеризовано как звучащее «немного не в такт». Это демонстрирует, что система еще не достигла идеальной точности в сложных и быстрых ритмических рисунках, характерных для рок-музыки.

В то же время попытка сыграть композицию "Roxanne" группы The Police оказалась более удачной. Ее звучание было описано как «более соответствующее остальной аранжировке», что указывает на способность ИИ адаптироваться к разным стилям и темпам. Исследование было загружено в базу препринтов ArXiv 15 июля.

Несмотря на достигнутый прогресс, общее звучание робота-барабанщика все еще «слегка неточное», что говорит о необходимости дальнейшего обучения. Разработчики подчеркивают, что игра на барабанах — это многогранная задача, требующая от исполнителя идеального чувства времени с точностью до долей секунды.

Кроме того, для успешного исполнения необходимо совершать быстрые контакты с поверхностями барабанов, координировать движения обеих рук и ног, а также поддерживать стабильный ритм на протяжении нескольких минут без ошибок. Эти сложности остаются ключевыми вызовами для роботизированных систем в области музыкального творчества.


Новое на сайте

19989Шесть историй, которые умещаются на ладони 19986Как 30 000 аккаунтов Facebook оказались в руках вьетнамских хакеров? 19985LofyGang вернулась: как бразильские хакеры охотятся на геймеров через поддельные читы 19984Автономная проверка защиты: как не отстать от ИИ-атак 19983Взлом Trellix: хакеры добрались до исходного кода одной из ведущих компаний по... 19982Почему почти 3000 монет в норвежском поле перевернули представление о викингах? 19981Как поддельная CAPTCHA опустошает ваш счёт и крадёт криптовалюту? 19980Слежка за каждым шагом: как ИИ превращает государство в машину тотального контроля 19979Как хакеры грабят компании через звонок в «техподдержку» 19978Почему именно Нью-Йорк стал самым уязвимым городом восточного побережья перед... 19977Как одна команда git push открывала доступ к миллионам репозиториев 19976Зачем древние народы убивали ножами и мечами: оружие как основа власти 19975Как Python-бэкдор DEEPDOOR крадёт ваши облачные пароли незаметно? 19974Послание в бутылке: математика невозможного 19973Почему ИИ-инфраструктура стала новой целью хакеров быстрее, чем ждали все?
Ссылка