🔥1
Fonte
Resumo em 10 segundos

O preço do token despencou, mas agentes de IA podem multiplicar a conta sem entregar mais resultado. 🤖📉

Tech
T
Tech @tech 1h

A IA ficou até 280x mais barata em 18 meses. Mesmo assim, o Uber consumiu em 4 meses todo o orçamento anual de IA, segundo relato divulgado em maio de 2026. 🤖💸🧵 A explicação não é simplesmente “a IA ficou cara”. É bem mais interessante.

Imagem do post
10 Fonte
Tech
T
Tech @tech 1h

Vamos separar duas métricas que parecem iguais, mas não são: • preço por token = quanto custa cada pedacinho de texto processado; • custo por tarefa = tudo o que a IA gasta para terminar um trabalho real. O primeiro caiu muito. O segundo pode explodir.

8
Tech
T
Tech @tech 1h

Em um chat simples, você pergunta e o modelo responde: consumo previsível. Já um agente de IA trabalha em etapas: chama ferramentas, confere resultados, corrige erros, consulta dados e carrega o contexto de volta a cada rodada. Cada passo soma custo.

Imagem do post
5
Tech
T
Tech @tech 1h

O detalhe técnico decisivo: a entrada de dados pode dominar a fatura. Se o agente reenviar um histórico enorme a cada etapa, o mesmo contexto é pago repetidas vezes. Na etapa 20, parte daquele material pode ter sido processada 20 vezes.

4
Tech
T
Tech @tech 1h

E havia outro problema no caso do Uber: ninguém conseguia atribuir claramente o gasto a cada time — nem comparar o consumo ao resultado entregue. Sem rastreabilidade, orçamento de IA vira uma conta coletiva: cresce rápido, mas ninguém sabe onde ajustar.

Imagem do post
5
Tech
T
Tech @tech 1h

Estudos com trajetórias de modelos de fronteira apontam uma variação enorme: a mesma tarefa pode consumir até 30x mais tokens entre execuções. Pior: modelos tendem a subestimar o próprio consumo antes de começar. Prever custo só pela “dificuldade aparente” falha bastante.

5
Tech
T
Tech @tech 1h

Mais gasto também não garante mais acerto. A qualidade costuma atingir um ponto ótimo em custo intermediário e depois estagnar. A lição: não basta comprar o modelo mais poderoso. É preciso medir custo por tarefa concluída, taxa de erro e qual indicador de negócio melhorou.

Imagem do post
5
Tech
T
Tech @tech 1h

Hardware mais eficiente e modelos mais baratos devem continuar reduzindo o preço unitário. Mas eficiência real depende de projeto: contexto enxuto, limites de execução, monitoramento e metas claras. Na era dos agentes, a pergunta não é “quanto custa o token?”. É: “o que cada tarefa resolveu?”

5
E aí, o que você achou?

Comentários 0