Ssylka

Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки

Ученые из Миланского политехнического университета (Politecnico di Milano) Асаф Али Шахид и Лорис Роведа разработали искусственный интеллект для симулированного гуманоидного робота, названного "Robot Drummer". Проект, идея которого возникла спонтанно за чашкой кофе, был нацелен на исследование возможностей роботов в творческих и экспрессивных сферах, таких как музыка, требующих сложной координации, ритма и физического исполнения.
Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки
Изображение носит иллюстративный характер

В основе системы лежит технология обучения с подкреплением (Reinforcement Learning, RL). В рамках этого метода искусственный интеллект, или «агент», обучается путем проб и ошибок. Взаимодействуя с окружением, в данном случае с виртуальной барабанной установкой, система получает математическое «вознаграждение» за правильные действия и «наказывается» за неверные. Конечная цель — найти оптимальную политику действий для максимизации вознаграждения.

Для симуляции использовалась модель гуманоидного робота G1 Unitree. Каждая песня представлялась для ИИ в виде цепочки точно рассчитанных по времени «событий контакта». Эти инструкции указывали роботу, по какому барабану и в какой именно момент необходимо нанести удар. Такой подход позволил системе обрабатывать сложные музыкальные партитуры.

В процессе обучения искусственный интеллект самостоятельно разработал продвинутые барабанные техники. Среди них — использование перекрестных ударов руками (cross-arm strikes) и адаптивное назначение палочек, при котором система сама решала, какой рукой эффективнее нанести тот или иной удар для достижения нужного звучания.

Демонстрация работы системы была опубликована на YouTube. В видеоролике трехмерная визуализация робота G1 играет на барабанной установке с цветовой кодировкой. Система была протестирована на более чем 30 популярных композициях в жанрах поп, рок, метал и джаз.

Исполнение песни "In the end" группы Linkin Park было охарактеризовано как звучащее «немного не в такт». Это демонстрирует, что система еще не достигла идеальной точности в сложных и быстрых ритмических рисунках, характерных для рок-музыки.

В то же время попытка сыграть композицию "Roxanne" группы The Police оказалась более удачной. Ее звучание было описано как «более соответствующее остальной аранжировке», что указывает на способность ИИ адаптироваться к разным стилям и темпам. Исследование было загружено в базу препринтов ArXiv 15 июля.

Несмотря на достигнутый прогресс, общее звучание робота-барабанщика все еще «слегка неточное», что говорит о необходимости дальнейшего обучения. Разработчики подчеркивают, что игра на барабанах — это многогранная задача, требующая от исполнителя идеального чувства времени с точностью до долей секунды.

Кроме того, для успешного исполнения необходимо совершать быстрые контакты с поверхностями барабанов, координировать движения обеих рук и ног, а также поддерживать стабильный ритм на протяжении нескольких минут без ошибок. Эти сложности остаются ключевыми вызовами для роботизированных систем в области музыкального творчества.


Новое на сайте

18302Можно ли предсказать извержение вулкана по его сейсмическому шёпоту? 18301Как случайное открытие позволило уместить радугу на чипе и решить проблему... 18300Визуальная летопись мира: триумфаторы 1839 Photography Awards 18299Загадка шагающих истуканов Рапа-Нуи 18298Двойное кометное зрелище украшает осеннее небо 18297Двигатель звездного роста: раскрыта тайна запуска протозвездных джетов 18296Нейробиология пробуждения: как мозг переходит от сна к бодрствованию 18295Как сервис для получения SMS-кодов стал оружием для мошенников по всему миру? 18294Сообщения в iOS 26: от ИИ-фонов до групповых опросов 18293Почему для исправления «техношеи» нужно укреплять мышцы, а не растягивать их? 18292Как новорожденная звезда подала сигнал из эпицентра мощнейшего взрыва? 18291Нотный рецепт: как наука превращает музыку в обезболивающее 18290Что превращает кофейное зерно в идеальный напиток? 18289Как пробуждение древних микробов и тайны черных дыр меняют наше будущее? 18288Как 3500-летняя крепость в Синае раскрывает секреты египетской военной мощи?