A disputa pelos dados da inteligência artificial
A regulamentação do uso de obras protegidas por direitos autorais no treinamento de IAs é um dos debates mais estratégicos de 2026, impactando inovação, propriedade intelectual e a economia global. Países buscam um equilíbrio entre o avanço
Publicado em 01 de out. de 2026 · Fonte: MIT Tech

A crescente dependência da Inteligência Artificial (IA) generativa em vastos volumes de dados para seu treinamento tem provocado um intenso debate global, especialmente no que tange ao uso de obras protegidas por direitos autorais. Em 2026, esta questão não é apenas técnica, mas estratégica, moldando o futuro da inovação, a proteção da propriedade intelectual e a remuneração de criadores. Modelos avançados de IA, capazes de gerar conteúdo novo, absorvem milhões de livros, artigos, fotos e músicas, levantando a fundamental questão jurídica: esse uso maciço exige autorização e compensação ou é legítimo para o avanço tecnológico?
A controvérsia não se restringe a fronteiras, revelando uma fragmentação regulatória que impacta a capacidade dos países de atrair investimentos e desenvolver tecnologia própria. A União Europeia, por exemplo, abordou o tema com sua Diretiva (EU) 2019/790, que reconhece a mineração de texto e dados (TDM) como essencial para a pesquisa e inovação. Contudo, a diretiva permite que titulares de direitos excluam suas obras, estabelecendo um equilíbrio entre a necessidade de acesso a dados em larga escala e a proteção autoral. Recentemente, o Regulamento Europeu de IA (AI Act) adicionou transparência, exigindo informações sobre os dados usados no treinamento, fortalecendo a rastreabilidade e governança.
O Dilema Brasileiro e o PL 2338/2023
No Brasil, a discussão ganha força com a tramitação do Projeto de Lei nº 2.338/2023, que visa estabelecer um marco regulatório para a IA. A legislação autoral brasileira, de 1998, é anterior à era da IA generativa e não contempla o uso de obras para treinamento de algoritmos. O cerne do debate é se as cópias técnicas geradas no treinamento são consideradas reproduções passíveis de autorização e remuneração. As propostas em discussão no PL 2338/2023 mostram uma inclinação a uma proteção mais rigorosa dos titulares de direitos, potencialmente resultando em um regime mais restritivo que o europeu, com exceções limitadas a pesquisa e instituições sem fins lucrativos.
Representantes de autores argumentam que a IA extrai valor de suas obras sem remuneração, defendendo mecanismos de autorização para preservar incentivos econômicos. Em contrapartida, empresas de tecnologia, pesquisadores e setores da economia digital alertam que exigir autorização individual para cada obra em conjuntos de dados que contêm bilhões de itens seria inviável, gerando custos de negociação proibitivos. A capacidade da IA generativa de reproduzir estilos e elementos de obras originais intensifica a preocupação com a exploração de mercados já estabelecidos por criadores.
Implicações Além dos Direitos Autorais
A discussão transcende a propriedade intelectual, abordando questões mais amplas como o acesso ao conhecimento, a diversidade cultural e a governança da informação. Práticas recentes de empresas de IA, que adquirem e digitalizam fisicamente livros em larga escala, muitas vezes descartando os originais, levantam preocupações sobre a concentração privada de vastos repositórios de conhecimento e a assimetria informacional. Este cenário exige a construção de soluções que garantam previsibilidade jurídica sem frear a inovação.
Alternativas como transparência nas fontes de dados, mecanismos de governança, sistemas de licenciamento coletivo e modelos de remuneração proporcional estão sendo discutidas globalmente. Sem um equilíbrio adequado, regras excessivamente restritivas podem diminuir o ritmo da inovação tecnológica no Brasil, afastando talentos, investimentos e tecnologias para outros países. A decisão regulatória sobre o treinamento de modelos de IA será crucial para definir a competitividade tecnológica do Brasil e sua participação na economia global orientada por dados nas próximas décadas.
Com informações de MIT Tech.
Perguntas frequentes
Por que o uso de obras protegidas para treinar IAs se tornou um problema?
Sistemas de IA generativa dependem de vastos volumes de dados, que frequentemente incluem materiais protegidos por direitos autorais. Isso levanta a questão se o uso dessas obras exige autorização e remuneração dos criadores, ou se é legítimo para o desenvolvimento tecnológico.
Como a União Europeia está abordando a questão dos direitos autorais na IA?
A UE, através da Diretiva (EU) 2019/790, reconhece a mineração de texto e dados como essencial para inovação, mas permite que titulares excluam suas obras. O AI Act adiciona requisitos de transparência sobre os dados usados no treinamento de IAs.
Qual é a situação da regulamentação de IA e direitos autorais no Brasil?
No Brasil, o Projeto de Lei nº 2.338/2023 busca criar um marco regulatório para a IA. A discussão central é se as cópias geradas no treinamento de IAs são reproduções que exigem autorização, com propostas tendendo a ser mais protetivas aos titulares de direitos do que as normas europeias.
Com informações de MIT Tech.
Este conteúdo pode conter links afiliados. Ao comprar por eles, o TechHoje pode receber comissão sem custo adicional para você.