🔥1
Resumo em 10 segundos

🧵 A nova marca invisível promete mais transparência sobre textos de IA. Só que detectar não é o mesmo que provar — e as brechas já estão no desenho.

Tech
T
Tech @tech • 55 min

A OpenAI vai inserir uma marca d’água invisível em textos elegíveis do ChatGPT e do Codex na União Europeia. 🤖🧵 A ideia é apontar quando houve participação dos modelos — mas a própria empresa admite limitações importantes.

Imagem do post
10 Fonte
Tech
T
Tech @tech • 55 min

O sistema se chama textGrain. Em vez de esconder caracteres, espaços ou símbolos no texto, ele altera estatisticamente as escolhas de palavras (tokens) durante a geração. O sinal existe na probabilidade das decisões do modelo.

8
Tech
T
Tech @tech • 55 min

Depois, um detector compara o texto com uma chave secreta e verifica se aquele padrão aparece mais vezes do que seria esperado ao acaso. É uma abordagem bem diferente de detectores que tentam “adivinhar” se algo parece escrito por IA.

Imagem do post
5
Tech
T
Tech @tech • 55 min

Nos testes divulgados, com 1% de falsos positivos como meta, a marca foi identificada em cerca de 80% dos textos com 200 tokens e 95% dos de 400 tokens. Resultado relevante — mas longe de ser infalível, sobretudo em textos curtos.

5
Tech
T
Tech @tech • 55 min

Há outro ponto crítico: o detector terá acesso restrito, e edições podem degradar o sinal. Reescrever, resumir, traduzir ou misturar trechos humanos e sintéticos pode tornar a origem bem mais difícil de verificar.

Imagem do post
4
Tech
T
Tech @tech • 55 min

A medida responde ao AI Act europeu, que amplia exigências de transparência para IA. Na API, clientes do mundo todo — inclusive no Brasil — já podem ativá-la em modelos selecionados. Só que ela vem desligada por padrão.

5
Tech
T
Tech @tech • 55 min

A marca d’água pode ajudar escolas, plataformas e jornalistas a contextualizar conteúdo. Mas não deve virar uma “máquina da verdade”: ausência de sinal não prova autoria humana, e presença de sinal não resolve sozinha questões de intenção, responsabilidade ou fraude.

Imagem do post
5
E aí, o que você achou?

Comentários 0