La revelación tiene eco en la comunidad tecnológica hispanohablante. The Atlantic publicó una base de datos searchable con millones de canciones usadas para IA. Dos sets contienen 12M y 9M tracks. Otros 100K cada uno. Descargas en miles. Google y Stability confirman uso en papers. Esto cuestiona los derechos de artistas. Muchas fuentes son libres para uso personal, no comercial. La brecha entre acceso y regulación crece. Profesionales deben exigir transparencia. La IA generativa depende de datos masivos. Sin marcos éticos, riesgos son elevados. Este caso es un espejo de la industria.
The Atlantic revela bases de datos de música para entrenar IA generativa
El proyecto expone la falta de transparencia en datos de entrenamiento. Más de 22 millones de canciones disponibles para investigación.
IAOnda Redaccion
sábado, 20 de junio de 2026
Comentarios
Cargando comentarios...
Relacionados
Claude lidera el 26% de la investigación de Anthropic, pero ¿qué significa?
Anthropic divulga por primera vez métricas internas que muestran que Claude 'lidera' el 26% del trabajo en futuros modelos, aunque el término tiene un significado má limitado de lo que parece. El enfoque de la compañía en la transparencia plantea preguntas sobre cómo se mide el progreso en la IA y su relevancia para competidores y reguladores.
PrismML lanza Ternary Bonsai 2 27B: el modelo de 5,9 GB que rivaliza con Qwen en rendimiento
Ternary Bonsai 2 27B comprime 27B parámetros en menos de 6 GB conservando el 98,2% del rendimiento original. Una apuesta por la eficiencia que democratiza la IA multimodal en dispositivos.
¿Están los benchmarks de IA midiendo la inteligencia real?
Un estudio revela que los benchmarks actuales de generalización sistemática en IA miden menos de lo que aparentan. El test TranSGrid revela caídas drásticas en modelos avanzados ante razonamiento genuino.