Meta se desmarca del porno torrentero para entrenar su Inteligencia Artificial

Meta se desmarca del porno torrentero para entrenar su Inteligencia Artificial
Meta ha desmentido rotundamente las acusaciones de haber usado torrents de porno y libros pirata para entrenar su IA. Su jefe de IA, Yann LeCun, asegura que solo emplearon 1.1 TB de libros de dominio público y 4 TB de datos de fuentes como Wikipedia y GitHub. La polémica surge por un blog anónimo.
0
0

¡Atención, cotillas de la IA! La polémica está servida y huele a… bueno, a lo que no debería oler el entrenamiento de una inteligencia artificial. Resulta que en el mundillo tech empezó a correr el rumor (vía un blog anónimo, que ya sabemos cómo es esto) de que Meta, la empresa de Mark Zuckerberg, había estado dándole al ‘torrent’ de porno y libros pirata para que sus cerebritos artificiales aprendieran del mundo. ¡Imaginen la escena en las oficinas!

Pero tranquilos, que el jefe de IA de Meta, Yann LeCun, ha salido al paso con un “¡De eso nada, monada!” en toda regla. Con la misma vehemencia con la que uno niega haberse comido el último trozo de tarta, LeCun ha desmentido rotundamente estas alegaciones que, seamos sinceros, suenan a una película de humor negro. Según él, en Meta no son de ir de “piratas” (en el sentido digital, claro está).

Entonces, ¿con qué se nutren estas mentes sintéticas tan avanzadas? Pues, al parecer, con cosas mucho más… digamos, académicas y aburridas. LeCun ha aclarado que la joya de la corona de su entrenamiento consiste en 1.1 terabytes de libros de dominio público. Sí, han leído bien, ¡libros! De esos que se leen en papel y huelen a viejo, pero en formato digital. Además, suman otros 4 terabytes de datos de fuentes tan insospechadas como Wikipedia, GitHub y, para rematar, artículos académicos. Vamos, que su IA se empapa de sabiduría, no de contenido… ejem… para adultos.

El tema es que la privacidad y los derechos de autor en el entrenamiento de IA son un melón que está dando mucho que hablar. Google también tuvo su ración de escándalo con supuestas conversaciones filtradas de Reddit. Pero por ahora, Meta se mantiene firme: su IA es más de biblioteca que de videoclub clandestino. Así que la próxima vez que chateéis con un bot de Meta, pensad que su conocimiento viene de clásicos literarios, no de las profundidades oscuras de internet. ¡Un alivio, oye!