Google lança modelo Gemini 4 Argon para desafiar GPT-6 Astra e Claude Opus 5.5, o preço cai significativamente

📅 2026-10-01

Resumo:

À medida que a OpenAI e a Anthropic continuam a lançar novas gerações de modelos de ponta, o Google lançou oficialmente o novo modelo carro-chefe de inteligência artificial Gemini 4 Argon, na esperança de entrar novamente na competição do mercado de modelos de ponta com capacidades de raciocínio de longo alcance mais fortes e preços mais competitivos.

1790825630_gemini_4_argon.webp

O Google posiciona o Gemini 4 Argon como um modelo de ponta para tarefas complexas e de longo prazo, com foco em áreas como desenvolvimento de software, trabalho de conhecimento empresarial e defesa de segurança de rede. No entanto, o modelo ainda não está totalmente aberto ao público. Em vez disso, será dada prioridade a algumas organizações de defesa de segurança de rede que participam do programa Google Fairwind para testes, enquanto o trabalho adicional de avaliação de segurança continua.

Em comparação com a série Gemini anterior, uma das atualizações mais importantes do Argon é o aumento substancial na capacidade de produção. O Google aumentou o comprimento máximo de saída de uma única transação dos 64.000 tokens anteriores para 1 milhão de tokens. Isso significa que o modelo pode concluir processos de inferência mais longos em uma única rodada de tarefas, executar projetos complexos de engenharia de software, tarefas de pesquisa e processamento de fluxo de trabalho em grande escala sem interrupções e reinicializações frequentes de tarefas.

Em termos de desempenho, vários resultados de testes de benchmark publicados pelo Google mostram que o Gemini 4 Argon supera o GPT-6 Astra da OpenAI e o Claude Opus 5.5 da Anthropic em diversas áreas importantes. Entre eles, Argon alcançou uma pontuação de 77,9% no teste DeepSWE v1.1 que mede capacidades de engenharia de software de longo prazo; uma pontuação de 51,3% no benchmark de tarefas automatizadas Zapier AutomationBench; e uma pontuação de 91,7% no teste de capacidade de compreensão de vídeos longos LVBench.

1790826191_google_gemini_4_argon.webp

O Google também afirmou que Argon também ficou em primeiro lugar no teste Vals Index, que avalia a capacidade de atividades econômicas reais, como finanças, direito, tributação e desenvolvimento de software. De acordo com dados oficiais, o modelo superou o GPT-6 Astra e o Claude Opus 5.5 em vários benchmarks importantes de IA.

Além dos resultados de testes externos, o Google revelou que o Argon foi colocado em uso real dentro da empresa. Milhares de funcionários estão usando o modelo para realizar tarefas como programação, pesquisa e documentação. Os casos de aplicação citados pelo Google incluem projetos de engenharia como otimização de algoritmos quânticos, otimização de recursos de memória de data center e migração de grandes bases de código C e C++ para a linguagem Rust.

A segurança cibernética é uma das principais áreas de fortalecimento da Argon. O Google disse que o modelo pode identificar, verificar e corrigir vulnerabilidades de software de forma autônoma. A equipe de segurança Wiz do Google usou o Argon para realizar tarefas de pesquisa de segurança por meio do programa “Scan for Good”. No teste CWE-bench v1, usado para avaliar os recursos de correção de vulnerabilidades, o Argon obteve uma pontuação de 68%, empatado com os melhores do setor.

Para aumentar a competitividade no mercado, desta vez o Google adotou uma estratégia de preços significativamente mais agressiva. O preço inicial do Gemini 4 Argon é de US$ 2 por 1 milhão de tokens de entrada e US$ 10 por 1 milhão de tokens de saída. O Google também oferece um desconto de 95% no armazenamento em cache do conteúdo de entrada. Em comparação, o preço é significativamente mais baixo do que alguns modelos concorrentes de última geração cobram atualmente.

Embora o desempenho e o preço tenham demonstrado forte competitividade, desta vez o Google optou por prosseguir com o ritmo de implantação com cautela. A empresa afirmou que o Gemini 4 Argon continuará a fornecer serviços de escopo limitado até que mais testes e verificações de segurança sejam concluídos, e um cronograma subsequente para uma abertura mais ampla ainda não foi anunciado.

Tags relacionadas

Artigos relacionados

Comentários

0/500
Captcha (click to refresh)
Sem comentários