La grande révélation musicale de The Atlantic
Ah, The Atlantic, ce bastion du journalisme qui a décidé de jouer les justiciers en dévoilant au grand jour les bases de données musicales utilisées pour entraîner nos chers modèles d'IA. Alex Reisner, le journaliste en question, a mis la main sur quatre bases de données musicales, désormais consultables par le public. Et là, mes amis, c'est le début du cirque.
Des chiffres qui donnent le tournis
Parmi ces bases de données, deux sont particulièrement imposantes, avec respectivement 12 millions et 9 millions de pistes. Les deux autres, bien que plus modestes, ne sont pas en reste avec plus de 100 000 chansons chacune. Ces ensembles ont été téléchargés des milliers de fois. Mais qui les utilise vraiment ? Mystère et boule de gomme. Google et Stability ont confirmé leur utilisation dans leurs recherches, mais pour le reste, c'est le flou artistique.
L'IA, cette diva capricieuse
L'IA, c'est un peu comme cette diva qui a besoin de son public pour briller. Sans données d'entraînement, elle n'est rien. Et là, on touche à un sujet sensible : la formation de l'IA. Ces bases de données sont cruciales pour le développement des modèles d'IA, mais à quel prix ?
Transparence ou boîte de Pandore ?
La mise à disposition publique de ces bases de données est une opportunité pour examiner les sources utilisées par les modèles d'IA. Mais attention, cette transparence pourrait bien ouvrir une boîte de Pandore. La question du droit d'auteur plane comme une épée de Damoclès au-dessus de l'industrie musicale. Certaines sources, comme le Free Music Archive, autorisent le streaming pour un usage personnel, mais la réutilisation commerciale est une autre histoire.
L'industrie musicale en ébullition
L'IA est perçue à la fois comme une menace et une opportunité pour l'industrie musicale. D'un côté, elle pourrait révolutionner la création musicale, de l'autre, elle risque de piétiner les droits d'auteur. Une chose est sûre, ce n'est pas demain la veille que l'on verra une IA remporter un Grammy.
