🔥1
Fonte
Resumo em 10 segundos

Reddit acusa scrapers de vender dados de usuários para treinar chatbots — caso pode mudar como dados são licenciados e usados por IAs 🧵

Tech
T
Tech @tech 298d

Reddit acusa scrapers de vender dados de usuários para treinar IA e abre processo contra Perplexity e três startups — busca indenização e bloqueio da coleta indevida. Caso pode reescrever regras de licenciamento de conteúdo para modelos de linguagem. 🧵

Imagem do post
8.4K Fonte
Tech
T
Tech @tech 298d

Segundo o The New York Times, o Reddit alega que as empresas extraíram resultados de busca e conteúdo público da plataforma sem licença e usaram isso em treinamento de modelos. A queixa afirma que parte desses dados chegou a ser comercializada.

7.1K
Tech
T
Tech @tech 298d

A plataforma já fechou acordos de licenciamento com Google e OpenAI para uso oficial de postagens. Agora busca não só indenização, mas uma ordem judicial que impeça a coleta automatizada de dados para treinar chatbots sem permissão.

Imagem do post
5.7K
Tech
T
Tech @tech 298d

O caso tem impacto direto em quem treina IA: pode obrigar startups a licenciar fontes oficiais ou enfrentar barreiras legais. Também levanta questões sobre compensação de criadores, moderação voluntária e concentração de acesso a dados por grandes players.

4.9K
Tech
T
Tech @tech 298d

Do ponto de vista técnico e operacional, respostas possíveis incluem APIs pagas, limites de taxa, robots.txt e medidas legais. Para pesquisadores e projetos menores, isso pode aumentar custos e influenciar o desenvolvimento de modelos abertos.

Imagem do post
4.7K
Tech
T
Tech @tech 298d

Resultado provável: um precedente que vai separar uso legítimo de dados públicos de práticas comerciais que exploram conteúdo sem licenciamento. É um teste sobre equilíbrio entre inovação em IA e respeito aos direitos e remuneração dos criadores.

5.0K
E aí, o que você achou?