Atlantic сделал музыкальную базу данных для ИИ - Новости IT perec.ru

Atlantic сделал музыкальную базу данных для ИИ

07.07.2026, 14:01:01 ИТ
Подписаться на «Рифы и пачки / Твоя культура»
Atlantic сделал музыкальную базу данных для ИИ

Журнал The Atlantic недавно сделал для широкой публики то, что можно было бы назвать мечтой или же ночным кошмаром владельцев прав на музыку. Репортёр Алекс Рейснер откопал и опубликовал открытый для поиска архив из четырёх огромных музыкальных датасетов, которые использовались для обучения всевозможных ИИ-алгоритмов. Два из этих наборов можно назвать настоящей музыкальной вселенной: там 12 миллионов и 9 миллионов треков соответственно. Не то чтобы остальные были крошечными — в каждом более 100 тысяч песен, что для мира обучающих данных по меркам человека почти вечность проигрывания.

Рейснер отмечает, что эти базы скачивались тысячи раз. Можно только догадываться, в чьих руках эти бесценные гигабайты – Google и Stability AI, например, в своих научных публикациях честно признались в использовании этих оцифрованных сокровищ. Откуда вообще берут такой музыкальный корм для ИИ? Например, в одном случае — из Free Music Archive, где музыка действительно разрешена для личного прослушивания, но едва ли для превращения в топливо для искусственного мозга.

Кто мог бы подумать, что в нашем веке «ноу-хау» — это не новый аккорд, а найти, где можно легально выкопать кучу MP3 для очередной ИИ-фабрики? Польза для обывателя есть: если вы когда-нибудь хотели узнать, попадёт ли ваша любимая подпольная группа в тренды искусственного интеллекта, теперь это можно проверить лично.


PEREC.RU

Создаётся ощущение, что The Atlantic соревнуется с крупными музыкальными лейблами в умении перерабатывать чужой контент в сырьё для искусственного интеллекта. Здесь нет ни кричащих роялти, ни переливов гитарных соло — только список из миллионов музыкальных файлов, которые с каждым скачиванием становятся ещё дальше от авторской уникальности. Парадокс: чем больше музыки — тем меньше человеческого в её слушателях. Проект выглядит попыткой собрать всё сразу, чтобы машины обучались не на шедеврах, а на индустриальных отходах переоцифрованного творчества. Впрочем, Google и другие коллекторы уже признали — их ИИ учатся на этих базах. Наблюдаем сдержанный восторг и лёгкое чувство, что экономят на композиторах. Мораль проста: кому принадлежит музыка в эпоху цифрового колониализма — тому, у кого можно скачать побольше?..

Поделиться

Похожие материалы