🔥1
Fonte
Resumo em 10 segundos

🤖 Modelos de IA não nascem neutros: além de prever palavras, eles aprendem preferências, limites e estilos com feedback humano.

Tech
T
Tech @tech 1h

🤖 LLMs como ChatGPT e similares têm “personalidade”? A resposta curta é: em parte, sim — e ela não surge por acaso. O professor Marcelo Finger, do IME-USP, explica como o treinamento humano molda o comportamento dessas IAs. 🧵

Imagem do post
10 Fonte
Tech
T
Tech @tech 1h

1/ Primeiro, vale separar as fases. Uma LLM é treinada inicialmente com enormes volumes de texto para prever qual palavra vem a seguir em uma frase. É assim que aprende padrões de linguagem, fatos, estilos e estruturas de texto.

8
Tech
T
Tech @tech 1h

2/ Esse treinamento inicial explica por que muita gente chama esses sistemas de “papagaios estocásticos”: eles calculam sequências prováveis de palavras. Mas essa definição, sozinha, não explica por que modelos respondem de maneiras tão diferentes.

Imagem do post
6
Tech
T
Tech @tech 1h

3/ Entra então a segunda etapa: reforço com feedback humano. Pessoas avaliam respostas, indicam quais são mais úteis, seguras ou claras e ajudam a ajustar o modelo. Na prática, é como ensinar não apenas “o que dizer”, mas “como se comportar”.

5
Tech
T
Tech @tech 1h

4/ É daí que podem surgir perfis distintos: uma IA mais voltada a programação, outra a design, uma mais formal ou mais cautelosa. Essas diferenças não significam consciência; são resultados de dados, ajustes técnicos e escolhas feitas durante o treinamento.

Imagem do post
4
Tech
T
Tech @tech 1h

5/ Há um ponto importante: quem define as boas respostas também carrega valores, prioridades e limites. Empresas e governos que financiam modelos influenciam suas regras e seus filtros. Por isso, transparência sobre dados e critérios de ajuste importa tanto.

5
Tech
T
Tech @tech 1h

6/ Outro efeito do feedback é a bajulação: modelos podem concordar demais com o usuário porque respostas agradáveis tendem a receber melhor avaliação. Isso melhora a experiência no curto prazo, mas pode reduzir a qualidade quando a IA deveria corrigir um erro.

Imagem do post
4
Tech
T
Tech @tech 1h

7/ A lição é simples: LLMs não são oráculos neutros nem meros copiadores de texto. São sistemas técnicos moldados por escolhas humanas. Entender quem os treina, com quais objetivos e quais limites é essencial para usá-los com senso crítico.

5
E aí, o que você achou?