Издание The Atlantic запустило публичную базу данных, где собрана музыка, использованная для тренировки систем искусственного интеллекта. Это важный шаг к прозрачности в сфере ИИ и авторских прав.
Журналист The Atlantic Алекс Райснер обнаружил четыре крупных набора данных с музыкальными произведениями, которые применялись для обучения ИИ-моделей. Два из этих наборов содержат колоссальное количество треков — 12 миллионов и 9 миллионов соответственно. Ещё два набора меньше, но также включают значительный объём контента. Теперь эта информация доступна для поиска всем желающим. Создание такой базы позволяет музыкантам и правообладателям проверить, использовались ли их произведения для обучения ИИ без разрешения. Это поднимает острые вопросы о компенсациях и этике использования чужого творчества, но одновременно даёт индустрии инструмент для диалога и возможных решений.









