CRIPTOMOEDAS

Google lança Gemini 4 e nova IA lidera testes de segurança digital

O Gemini 4 finalmente chegou, uma semana após o lançamento do Claude Opus 5.5 e um dia após o GPT…

O Gemini 4 finalmente chegou, uma semana após o lançamento do Claude Opus 5.5 e um dia após o GPT 6.1 Sol, provando que os laboratórios americanos estão muito empenhados em desacelerar o desenvolvimento da inteligência artificial. Perdoem nosso sarcasmo.

O Google revelou o Gemini 4 Argon na quarta-feira, chamando-o de seu modelo de vanguarda — ou seja, o mais capaz — para codificação, trabalho de escritório e defesa cibernética.

No DeepSWE v1.1, um teste para verificar se uma inteligência artificial consegue concluir tarefas de engenharia de software longas, complexas e do mundo real, pontuado em porcentagem, o Argon atingiu 77,9%. O Claude Opus 5.5 obteve 74,2%, o GPT-6 Astra 74,1% e o Claude Fable 5.1 67,4%.

Para se ter uma ideia, o Gemini 3.6 Flash alcançou 49% no mesmo teste em julho. O Argon também pode escrever até 1 milhão de tokens em uma única resposta, um aumento em relação aos 64.000 tokens anteriores. Um token é um pedaço de texto, aproximadamente três quartos de uma palavra, o que significa cerca de 750.000 palavras em comparação com aproximadamente 48.000.

No entanto, esses números devem ser vistos com ressalvas. O Google calculou sua própria pontuação DeepSWE, enquanto os números dos concorrentes vieram de um ranking público e relatórios de empresas. Sua tabela também admite desvantagens. O Argon lidera em 12 de 18 benchmarks, empata em um e fica atrás em cinco, uma mistura de testes de codificação, ciência e controle de computador.

Leia também: Claude Opus 5.5: nova IA da Anthropic chega 60% mais barata

Mas o recurso mais chamativo do modelo são suas capacidades cibernéticas. Esconder uma instrução secreta dentro de um e-mail, esperar que um assistente de IA o leia e ver se a inteligência artificial obedece ao estranho em vez de você. Isso é injeção indireta de prompt, e é o pesadelo para qualquer um que queira entregar sua caixa de entrada ou carrinho de compras a uma IA.

No benchmark de Injeção Indireta de Prompt da Gray Swan, que esconde instruções maliciosas em conteúdos lidos por agentes e pontua a frequência com que os ataques funcionam dentro de 15 tentativas, o Argon atingiu 0,7%. Quanto menor, melhor. O Claude Opus 5.5 e o Claude Fable 5.1 ambos marcaram 1,0%.

O GPT-6 Astra ficou em 8,5%. O Grok 4.6 e o Kimi K3 foram enganados em pouco mais da metade das vezes, com 51,8% e 52,7%.

O Argon é disponibilizado para equipes de segurança verificadas através do Programa Fairwind, a iniciativa de defesa cibernética de acesso limitado do Google, que foi lançada em 2 de setembro com mais de 650 parceiros, incluindo governos e operadores de infraestruturas críticas. E ele é entregue “sem as barreiras de segurança cibernética”, as recusas embutidas que normalmente impedem um modelo de auxiliar em hacking.

A lógica por trás de tal movimento é que os defensores precisam de um modelo que possa pensar como um atacante para corrigir vulnerabilidades antes que os criminosos as encontrem. A questão é que a mesma habilidade funciona nos dois sentidos, então o Google afirma que um lançamento faseado é o único caminho seguro. A empresa também está participando do processo voluntário do governo dos EUA para acesso a modelos pré-lançamento.

O Google não é o primeiro a colocar um modelo cibernético sob acesso restrito. Uma versão inicial do Claude Mythos da Anthropic ajudou a encontrar 271 vulnerabilidades no Firefox, o que significa 271 falhas de segurança que a Mozilla posteriormente corrigiu. A OpenAI adotou um caminho semelhante com seu programa Trusted Access for Cyber.

As pontuações cibernéticas do Argon superam as do Gemini 3.8 Flash Cyber, o modelo restrito que o Google lançou com o Fairwind. No Wiz Penetration Test Benchmark, um teste interno do Google que pede a uma inteligência artificial para escrever exploits funcionais contra falhas reais de aplicações web sem ver o código, e pontua a proporção resolvida na primeira tentativa, o Argon atingiu 70,9% contra 58,2%.

O Google também afirma que o Argon ajudou a empresa de segurança Wiz a encontrar uma falha crítica em um software de saúde usado por hospitais em todo o mundo, que modelos de fronteira anteriores haviam perdido.

O lançamento segue um verão difícil para o Google. Em julho, ele lançou modelos Flash menores, mas pulou o prometido Gemini 3.5 Pro, e as ações da Alphabet caíram cerca de 4,4%. O Argon também chegou no mesmo dia em que o presidente Donald Trump revelou um acordo voluntário e sem penalidades sobre IA que a liderança do Google assinou.

O Google afirma que o lançamento mais amplo ocorrerá o mais rápido possível, começando com clientes API pagos e assinantes do Google AI Ultra.

Os preços de introdução são de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. O Google não informou quando esse período termina, apenas que as taxas padrão são de US$ 4 e US$ 20.

* Traduzido e editado com autorização do Decrypt.

A porta de entrada para o bitcoin, a maior criptomoeda do mundo, está no MB. É simples, seguro e transparente. Deixe de adiar um investimento com potencial gigantesco. Invista em poucos cliques!

O post Google lança Gemini 4 e nova IA lidera testes de segurança digital apareceu primeiro em Portal do Bitcoin.

Fonte: Portal do Bitcoin

Perguntas frequentes

Respostas institucionais sobre esta cobertura, fontes e limites editoriais.

Sobre o que trata “Google lança Gemini 4 e nova IA lidera testes de…”?
O Gemini 4 finalmente chegou, uma semana após o lançamento do Claude Opus 5.5 e um dia após o GPT 6.1 Sol, provando que os laboratórios americanos estão muito empenhados em desacelerar o desenvolvimento da inteligência…
Por que Criptomoedas importa agora?
O tema impacta decisões e debates cotidianos ligados a Criptomoedas. A redação destaca fatos, datas e implicações práticas sem substituir orientação profissional personalizada.
Quem edita o conteúdo do Estrato Tech?
A cobertura é produzida e revisada pela equipe editorial do Estrato Tech, com editor-chefe responsável pela linha editorial. Conheça a redação em https://tech.estrato.cc/equipe/.
Quais fontes o Estrato prioriza?
Priorizamos fontes primárias (órgãos oficiais, balanços, estudos revisados, documentos públicos) e cruzamos informações antes da publicação, conforme a política editorial.
Como solicitar correção de uma matéria?
Envie o pedido pela página de Correções (https://tech.estrato.cc/correcoes/) ou Contato (https://tech.estrato.cc/contato/). Erros materiais são corrigidos com registro da atualização.
O conteúdo constitui aconselhamento profissional?
Não. As matérias têm caráter informativo e jornalístico. Decisões financeiras, de saúde, jurídicas ou educacionais devem considerar profissionais habilitados e a sua situação particular.
Onde acompanhar a política editorial do Estrato Tech?
Metodologia, ética e transparência estão em https://tech.estrato.cc/metodologia/, https://tech.estrato.cc/etica-editorial/ e https://tech.estrato.cc/politica-editorial/.
Como o Estrato trata temas sensíveis (YMYL)?
Temas que afetam dinheiro, saúde e bem-estar recebem revisão editorial reforçada, disclaimer visível e links para páginas institucionais de metodologia e correções. Portal: https://tech.estrato.cc/
WhatsApp X LinkedIn
Compartilhar: LinkedIn
Thiago Mello

Thiago Mello

Thiago Mello integra a equipe editorial do Estrato Tech, vertical da rede Estrato, na função de Repórter de Infra e cloud. O escopo permanente de cobertura inclui infraestrutura e dados, com atenção ao leitor brasileiro que busca contexto factual, datas oficiais e implicações práticas. Na produção diária, prioriza fontes primárias (órgãos públicos, balanços, papers e documentos oficiais), cruza pelo menos duas referências independentes quando o tema é contestado e evita manchetes que prometam certeza onde há incerteza. Critérios de qualidade: lead com o fato principal, atribuição clara de autoria da equipe Estrato, atualização com selo quando há mudança material e linguagem acessível sem simplificar demais o risco ou o contexto. Trabalha sob revisão da mesa editorial e do editor-chefe do portal. Matérias YMYL recebem segunda leitura antes da publicação e podem ser atualizadas quando surgem novos dados oficiais. Limites: este perfil descreve o papel editorial na marca Estrato. O conteúdo publicado é informativo e não constitui aconselhamento médico, financeiro, jurídico ou profissional personalizado. Transparência ao leitor: metodologia em /metodologia/, ética em /etica-editorial/, correções em /correcoes/, equipe em /equipe/ e canal em /contato/ ([email protected]). Na página-mãe da rede, a bio ampliada e o arquivo de matérias ficam em estrato.cc/blog/, com link para o arquivo do autor em cada portal.

Deixe um comentário