🔥1
Fonte
Resumo em 10 segundos

🤖🔐 O novo modelo do Google avançou em programação e chamou atenção pela defesa contra instruções maliciosas escondidas em conteúdos. Entenda os números sem cair no hype.

Tech
T
Tech @tech • 46 min

O Google apresentou o Gemini 4 Argon, sua nova IA de ponta, com promessa de ajudar em programação, tarefas de escritório e defesa cibernética. O destaque: resistência maior a ataques que tentam manipular assistentes por conteúdos aparentemente inocentes. 🤖🔐 🧵

Imagem do post
9 Fonte
Tech
T
Tech @tech • 46 min

Primeiro, o desempenho em programação: no DeepSWE v1.1 — teste de tarefas longas e reais de engenharia de software — o Argon marcou 77,9%. Na comparação divulgada, Claude Opus 5.5 fez 74,2% e GPT-6 Astra, 74,1%.

8
Tech
T
Tech @tech • 46 min

O salto parece grande: um Gemini 3.6 Flash havia atingido 49% no mesmo teste, segundo os dados citados. Mas há uma ressalva importante: a pontuação do Google foi calculada pela própria empresa, enquanto rivais vieram de rankings e relatórios públicos.

Imagem do post
6
Tech
T
Tech @tech • 46 min

Outro número impressiona: o Argon pode gerar até 1 milhão de tokens em uma resposta. Em termos simples, token é um pedaço de texto; isso equivale, aproximadamente, a 750 mil palavras. Na prática, abre espaço para analisar projetos e documentos muito extensos.

4
Tech
T
Tech @tech • 46 min

A parte mais relevante para segurança é a proteção contra injeção indireta de prompt. É quando uma instrução maliciosa fica escondida em um e-mail, página ou arquivo e tenta fazer a IA ignorar o comando do usuário — por exemplo, vazar dados ou executar uma ação indevida.

Imagem do post
5
Tech
T
Tech @tech • 46 min

No teste da Gray Swan, quanto menor a taxa, melhor: o Gemini 4 Argon teve 0,7% de sucesso dos ataques em até 15 tentativas. Claude Opus 5.5 marcou 1,0%; GPT-6 Astra, 8,5%. Ainda assim, benchmark não substitui auditoria independente e proteção contínua no produto real.

4
Tech
T
Tech @tech • 46 min

A lição não é que uma IA ficou “invencível”. É que, à medida que assistentes ganham acesso a e-mails, arquivos e sistemas, segurança precisa evoluir no mesmo ritmo. Modelos mais capazes são úteis — desde que venham com testes transparentes, limites claros e supervisão humana.

Imagem do post
5
E aí, o que você achou?

Comentários 0