Следите за новостями по этой теме!
Подписаться на «Рифы и пачки / Твоя культура»
Журнал The Atlantic недавно сделал для широкой публики то, что можно было бы назвать мечтой или же ночным кошмаром владельцев прав на музыку. Репортёр Алекс Рейснер откопал и опубликовал открытый для поиска архив из четырёх огромных музыкальных датасетов, которые использовались для обучения всевозможных ИИ-алгоритмов. Два из этих наборов можно назвать настоящей музыкальной вселенной: там 12 миллионов и 9 миллионов треков соответственно. Не то чтобы остальные были крошечными — в каждом более 100 тысяч песен, что для мира обучающих данных по меркам человека почти вечность проигрывания.
Рейснер отмечает, что эти базы скачивались тысячи раз. Можно только догадываться, в чьих руках эти бесценные гигабайты – Google и Stability AI, например, в своих научных публикациях честно признались в использовании этих оцифрованных сокровищ. Откуда вообще берут такой музыкальный корм для ИИ? Например, в одном случае — из Free Music Archive, где музыка действительно разрешена для личного прослушивания, но едва ли для превращения в топливо для искусственного мозга.
Кто мог бы подумать, что в нашем веке «ноу-хау» — это не новый аккорд, а найти, где можно легально выкопать кучу MP3 для очередной ИИ-фабрики? Польза для обывателя есть: если вы когда-нибудь хотели узнать, попадёт ли ваша любимая подпольная группа в тренды искусственного интеллекта, теперь это можно проверить лично.
Создаётся ощущение, что The Atlantic соревнуется с крупными музыкальными лейблами в умении перерабатывать чужой контент в сырьё для искусственного интеллекта. Здесь нет ни кричащих роялти, ни переливов гитарных соло — только список из миллионов музыкальных файлов, которые с каждым скачиванием становятся ещё дальше от авторской уникальности. Парадокс: чем больше музыки — тем меньше человеческого в её слушателях. Проект выглядит попыткой собрать всё сразу, чтобы машины обучались не на шедеврах, а на индустриальных отходах переоцифрованного творчества. Впрочем, Google и другие коллекторы уже признали — их ИИ учатся на этих базах. Наблюдаем сдержанный восторг и лёгкое чувство, что экономят на композиторах. Мораль проста: кому принадлежит музыка в эпоху цифрового колониализма — тому, у кого можно скачать побольше?..