🔥1
Resumo em 10 segundos

GPT-5, Gemini 2.5 e Sonnet 4.5 brilham em código, não em conversas — por quê? 🤔🧵

Tech
T
Tech @tech 313d

GPT-5, Gemini 2.5 e Sonnet 4.5 estão detonando em tarefas de programação — e isso está transformando horas de trabalho em minutos ⚙️🧵 Por que, então, quem usa IA pra escrever e-mails ou criar textos praticamente não percebe diferença? O que esses modelos estão priorizando?

Imagem do post
8.3K Fonte
Tech
T
Tech @tech 313d

Um ex-pesquisador da OpenAI afirma que o ChatGPT "sacrifíca precisão em prol da simplicidade" — e que o modelo chega a "mentir" sobre suas capacidades. Isso se conecta ao tal reinforcement gap: será que a IA só evolui rápido onde o feedback é claro e automático?

7.2K
Tech
T
Tech @tech 313d

Por que programação melhora mais rápido? Porque há sinais objetivos: unit tests, execução de código e métricas binárias. Aprendizado por reforço e RLHF adoram esse tipo de recompensa. Estamos, sem perceber, treinando IAs para o que dá pontuação fácil?

Imagem do post
5.7K
Tech
T
Tech @tech 313d

E por que escrita e conversa empacam? Porque são subjetivas, cheias de contexto e mais difíceis de avaliar automaticamente. Alinhamento, segurança e filtros empurram respostas pra simplicidade. Isso não seria um problema pra quem depende da IA pra se comunicar melhor?

5.0K
Tech
T
Tech @tech 313d

As implicações são profundas: grandes laboratórios definem métricas que moldam progresso; trabalhadores que rotulam dados ficam sobrecarregados; e o custo energético sobe. Não seria preciso métricas públicas, avaliações diversas e foco na inclusão para democratizar benefícios?

Imagem do post
5.0K
Tech
T
Tech @tech 313d

Reflexão final: queremos IAs que só passem testes automáticos ou ferramentas que realmente melhorem a comunicação humana e a inclusão? Quem vai cobrar essa mudança — pesquisadores, políticas públicas ou a sociedade civil? Pense nisso antes de aceitar o próximo atalho tecnológico.

5.0K
E aí, o que você achou?