Музыка и ИИ

Nao Tokui — Emergent Rhythm

Диджей играет ещё не существующие треки

Третья часть AI DJ Project: на MUTEK.JP Nao Tokui сводит сет из ритмов и мелодий, которые нейросети генерируют прямо во время выступления. Токио, декабрь 2022.

Nao Tokui — Emergent Rhythm
Изображение с официальной страницы проекта

В декабре 2022-го Nao Tokui показал Emergent Rhythm — аудиовизуальный диджей-сет, третью часть своего AI DJ Project. Премьера прошла 8 декабря на фестивале MUTEK.JP в токийском Shibuya Stream Hall. Проект начинался в 2016-м как back-to-back-сессия, потом превратился в лайв с символьной (MIDI) генерацией; здесь же весь звук производится нейросетями прямо на сцене — без синтезаторов и драм-машин.

Как это устроено: GAN-модели, обученные на спектрограммах, генерируют новые спектрограммы, а вокодерные сети превращают их в звук. Визуальный ряд собран из более чем миллиона изображений, созданных Stable Diffusion. На сцене Токуи запускает несколько моделей, спонтанно генерирует ритмы и мелодии и сводит полученные петли, а плагин Neutone — он разрабатывался с его участием — меняет тембр входящего аудио в реальном времени. В титрах — визуальные программисты Ryosuke Nakajima и Keito Takaishi (Qosmo), танцовщица Masumi Endo и режиссёр пластики Maiko Kuno.

Коллекция возникает на месте

У диджея обычно есть память о готовых записях: он знает, где начинается нужный фрагмент и сколько осталось до перехода. Здесь этой опоры нет — материал рождается на глазах, и его надо быстро оценить и встроить в уже идущий сет. Свою роль Токуи называет «AI Jockey»: человек укрощает поток машинного звука в реальном времени. Мне проект интересен именно этим: обычные диджейские навыки — слух, чувство длительности, чувство момента — работают с непривычным источником материала.

Источники и музыка

  1. Nao Tokui — Emergent Rhythm
Музыка и ИИ — все материалы