Faça a sua assinatura

Legendas de séries de TV foram usadas para treinar IAs

Sistemas de IA como os chatbots são treinados com grandes volumes de dados, incluindo diálogos de filmes e séries extraídos de legendas do site OpenSubtitles.org. Este conjunto de dados, que contém diálogos de mais de 53 mil filmes e 85 mil episódios de TV, foi usado por diversas empresas, como Meta, Apple e Nvidia, para desenvolver modelos de linguagem.

Assine a newsletter o Futuro Explicado

Apesar de ser uma prática comum, muitas dessas obras estão protegidas por direitos autorais, levantando questões sobre a legalidade e a ética do uso não autorizado de materiais criativos para fins comerciais. As empresas argumentam que essa prática é “uso justo”, mas ações legais de artistas e escritores colocam em dúvida essa justificativa.

Escute aqui o episódio desta semana do podcast RESUMIDO 

Além disso, o treinamento em legendas traz um desafio técnico, pois elas são fragmentadas e descontextualizadas. Contudo, são valiosas para ensinar os chatbots a reproduzir a linguagem natural. Essa situação exemplifica a falta de transparência e o impacto sobre os artistas, cujos trabalhos são usados para treinar tecnologias que podem substituir suas funções.

Mais detalhes na reportagem da The Atlantic.

Leia mais: Este cara te ensina a melhorar sua relação com as notícias

O futuro explicado.