Google lança Gemini 3.6 Flash e 3.5 Flash-Lite, com Flash Cyber em projeto-piloto limitado
Google lançou dois modelos Gemini Flash em 21 de julho, enquanto seu modelo de cibersegurança continua restrito a um projeto-piloto limitado do CodeMender.
Google anunciou Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e Gemini 3.5 Flash Cyber em 21 de julho de 2026. Os dois primeiros modelos já estão disponíveis em vários produtos e ambientes de desenvolvimento do Google. Flash Cyber não está disponível ao público em geral: ele é usado apenas em um projeto-piloto do CodeMender com acesso limitado a governos e parceiros confiáveis.
O que os três modelos realmente fazem
Gemini 3.6 Flash é o modelo principal do lançamento. Google o posiciona para programação, trabalho com conhecimento e tarefas multimodais. Ele custa US$ 1,50 por 1 milhão de tokens de entrada e US$ 7,50 por 1 milhão de tokens de saída. Esse preço é superior ao do novo modelo Flash-Lite, portanto a questão prática é se os resultados mais fortes nos benchmarks e o menor uso de tokens justificam a diferença para determinada carga de trabalho.
Google informa que Gemini 3.6 Flash reduz em 17% o uso de tokens de saída em comparação com 3.5 Flash no Artificial Analysis Index. Em alguns casos do DeepSWE, a redução chega a 65%. A redução de tokens importa independentemente do preço por token anunciado, pois um modelo que gera menos tokens de saída pode diminuir o custo total para concluir uma tarefa.
As mudanças divulgadas nos benchmarks comparam o novo modelo ao anterior:
- DeepSWE: 49% contra 37%.
- MLE Bench: 63,9% contra 49,7%.
- OSWorld-Verified: 83,0% contra 78,4%.
- GDPval-AA v2: 1421 contra 1349.
Gemini 3.5 Flash-Lite é voltado a tarefas rápidas, econômicas e de alto volume. Ele custa US$ 0,30 por 1 milhão de tokens de entrada e US$ 2,50 por 1 milhão de tokens de saída. Google informa uma velocidade de 350 tokens de saída por segundo no Artificial Analysis Index. Os resultados divulgados nos benchmarks também superam os do modelo anterior:
- Terminal-Bench 2.1: 54% contra 31%.
- GDM-MRCR v2: 72,2% contra 60,1%.
- GDPval-AA v2: 1140 contra 642.
- SWE-Bench Pro: 54,2% contra 49,6%.
- OSWorld-Verified: 74,0% contra 65,1%.
Gemini 3.5 Flash Cyber tem um propósito mais específico. É um modelo de cibersegurança para detectar vulnerabilidades e aplicar correções. Sua implantação restrita reflete a natureza de uso duplo do modelo. Google o disponibiliza apenas por meio do CodeMender, e não nos ambientes gerais do Gemini usados pelos outros dois modelos. Os detalhes completos estão no anúncio do Google.
O que isso significa ao escolher ferramentas
Para equipes que já usam Gemini, o lançamento cria uma divisão mais clara entre um modelo principal de uso geral e uma opção voltada a alto volume. Gemini 3.6 Flash atende a tarefas de programação, multimodais e de conhecimento nas quais os resultados mais fortes divulgados ou a menor extensão das respostas sejam relevantes. Gemini 3.5 Flash-Lite é adequado a cargas de trabalho em que o preço de entrada e saída, a velocidade e o volume sejam as principais restrições. As duas tabelas de preços permitem estimar a diferença de custo entre os modelos antes de testar a qualidade em um conjunto representativo de tarefas.
Desenvolvedores podem acessar os dois modelos de uso geral pela Gemini API. Google AI Studio está entre os pontos de acesso anunciados para Gemini 3.6 Flash, junto com Android Studio. Equipes que comparam fluxos de programação também podem analisar esses resultados no contexto de Gemini CLI, GitHub Copilot e Cursor. Essas ferramentas não substituem a avaliação por benchmarks: a escolha relevante depende do acesso ao modelo, da interface e do fluxo de trabalho de que cada equipe precisa. Outras opções estão reunidas na categoria de Programação.
A disponibilidade varia conforme o produto. Gemini 3.6 Flash está disponível na Gemini API por meio do Google AI Studio e Android Studio, além de Gemini Enterprise Agent Platform, aplicativo Gemini e Google Antigravity. Gemini 3.5 Flash-Lite está disponível na Gemini API, Gemini Enterprise Agent Platform, aplicativo Gemini e Google Search. Isso significa que ambos já podem ser testados pela API, embora não sejam distribuídos nos mesmos ambientes adicionais.
Limitações e o que ainda não está disponível
Gemini 3.5 Flash Cyber não é uma API aberta nem um produto lançado amplamente. O acesso está limitado ao projeto-piloto do CodeMender para governos e parceiros confiáveis. Empresas não devem planejar uma integração geral em produção com esse modelo, a menos que participem desse programa restrito. O anúncio define seu foco na detecção e correção de vulnerabilidades, mas não o transforma em mais uma opção da linha Flash disponível aos usuários comuns da Gemini API.
Dois itens futuros também foram anunciados, mas ainda não tiveram lançamento geral. Gemini 3.5 Pro está em testes com parceiros, com disponibilidade geral planejada. Gemini 4 está em uma fase anterior: o pré-treinamento está em andamento. Nenhuma dessas declarações significa que os modelos estejam disponíveis hoje, e Google não informa uma data de lançamento geral neste anúncio.
Portanto, a decisão imediata é entre Gemini 3.6 Flash e Gemini 3.5 Flash-Lite, ambos já ativos nos ambientes indicados. Os próximos pontos a acompanhar são a disponibilidade geral do Gemini 3.5 Pro e uma possível expansão do Flash Cyber para além da implantação de acesso limitado do CodeMender. Gemini 4 continua sendo um sinal de desenvolvimento, e não um produto que as equipes possam selecionar hoje.
ai101
Ferramentas nesta publicação
Gemini
FreemiumAssistente do Google integrado à Busca, Gmail e Docs
Google AI Studio
FreemiumAmbiente do Google para criar com os modelos Gemini
Gemini CLI
FreemiumAgente de IA no terminal para analisar, automatizar e depurar
GitHub Copilot
FreemiumProgramador parceiro com IA dentro do seu editor
Cursor
FreemiumO editor de código criado com IA no centro
Continue lendo
Claude agora marca textos e arquivos processados por seus modelos
Claude agora adiciona marcas d’água em textos e metadados C2PA em arquivos, mas uma marca detectada indica processamento pelo Claude, não autoria.
Meta lança Muse Code, agente de programação para fluxos multiagente
A Meta lançou o Muse Code em beta inicial junto com o Muse Spark 1.2, oferecendo CLI nativa, subagentes observáveis e logs de eventos reproduzíveis.
Meta AI torna-se um agente que atua com o Muse Spark 1.1
Meta AI ganha planejamento, tarefas conectadas, orientação em tempo real e trabalhos recorrentes com o Muse Spark 1.1, inicialmente em mercados selecionados.