Ssylka

Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки

Ученые из Миланского политехнического университета (Politecnico di Milano) Асаф Али Шахид и Лорис Роведа разработали искусственный интеллект для симулированного гуманоидного робота, названного "Robot Drummer". Проект, идея которого возникла спонтанно за чашкой кофе, был нацелен на исследование возможностей роботов в творческих и экспрессивных сферах, таких как музыка, требующих сложной координации, ритма и физического исполнения.
Кибернетический ритм: ИИ осваивает барабаны через пробы и ошибки
Изображение носит иллюстративный характер

В основе системы лежит технология обучения с подкреплением (Reinforcement Learning, RL). В рамках этого метода искусственный интеллект, или «агент», обучается путем проб и ошибок. Взаимодействуя с окружением, в данном случае с виртуальной барабанной установкой, система получает математическое «вознаграждение» за правильные действия и «наказывается» за неверные. Конечная цель — найти оптимальную политику действий для максимизации вознаграждения.

Для симуляции использовалась модель гуманоидного робота G1 Unitree. Каждая песня представлялась для ИИ в виде цепочки точно рассчитанных по времени «событий контакта». Эти инструкции указывали роботу, по какому барабану и в какой именно момент необходимо нанести удар. Такой подход позволил системе обрабатывать сложные музыкальные партитуры.

В процессе обучения искусственный интеллект самостоятельно разработал продвинутые барабанные техники. Среди них — использование перекрестных ударов руками (cross-arm strikes) и адаптивное назначение палочек, при котором система сама решала, какой рукой эффективнее нанести тот или иной удар для достижения нужного звучания.

Демонстрация работы системы была опубликована на YouTube. В видеоролике трехмерная визуализация робота G1 играет на барабанной установке с цветовой кодировкой. Система была протестирована на более чем 30 популярных композициях в жанрах поп, рок, метал и джаз.

Исполнение песни "In the end" группы Linkin Park было охарактеризовано как звучащее «немного не в такт». Это демонстрирует, что система еще не достигла идеальной точности в сложных и быстрых ритмических рисунках, характерных для рок-музыки.

В то же время попытка сыграть композицию "Roxanne" группы The Police оказалась более удачной. Ее звучание было описано как «более соответствующее остальной аранжировке», что указывает на способность ИИ адаптироваться к разным стилям и темпам. Исследование было загружено в базу препринтов ArXiv 15 июля.

Несмотря на достигнутый прогресс, общее звучание робота-барабанщика все еще «слегка неточное», что говорит о необходимости дальнейшего обучения. Разработчики подчеркивают, что игра на барабанах — это многогранная задача, требующая от исполнителя идеального чувства времени с точностью до долей секунды.

Кроме того, для успешного исполнения необходимо совершать быстрые контакты с поверхностями барабанов, координировать движения обеих рук и ног, а также поддерживать стабильный ритм на протяжении нескольких минут без ошибок. Эти сложности остаются ключевыми вызовами для роботизированных систем в области музыкального творчества.


Новое на сайте

18587Как одна ошибка в коде открыла для хакеров 54 000 файрволов WatchGuard? 18586Криптовалютный червь: как десятки тысяч фейковых пакетов наводнили npm 18585Портативный звук JBL по рекордно низкой цене 18584Воин-крокодил триаса: находка в Бразилии связала континенты 18583Опиум как повседневность древнего Египта 18582Двойной удар по лекарственно-устойчивой малярии 18581Почему взрыв массивной звезды асимметричен в первые мгновения? 18580Почему самые удобные для поиска жизни звезды оказались наиболее враждебными? 18579Смертоносные вспышки красных карликов угрожают обитаемым мирам 18578Почему самый активный подводный вулкан тихого океана заставил ученых пересмотреть дату... 18577Вспышка на солнце сорвала запуск ракеты New Glenn к Марсу 18576Как фишинг-платформа Lighthouse заработала миллиард долларов и почему Google подала на... 18575Почему космический мусор стал реальной угрозой для пилотируемых миссий? 18574Зеленый свидетель: как мох помогает раскрывать преступления 18573Инфраструктурная гонка ИИ: Anthropic инвестирует $50 миллиардов для Claude