🧠 Um estudo de Meta, MIT e UW propõe modelos que organizam a própria “memória” durante a tarefa — e podem reduzir muito o processamento em produção.
DeepSeek lançou o DeepSeek-V3.2-Exp, com Sparse Attention para sequências longas — eficiência e debate sobre acesso à tecnologia 🧠✨
Nem toda tarefa precisa de um modelo gigante. Empresas estão descobrindo que IAs menores podem ser mais rápidas, baratas e controláveis. 🤖⚡