O Google lança três novos modelos, incluindo o Gemini 3.6 Flash! O 3.5 Flash-Lite dispara em altíssima velocidade, e o treinamento antecipado do Gemini 4 já foi iniciado

De acordo com o anúncio do blog oficial do Google, o Google lançou oficialmente em 21 de julho a nova série de modelos Flash de geração mais recente, incluindo Gemini 3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber. Os novos modelos são feitos especificamente para fluxos de trabalho de agentes de IA (AI agents); não apenas reduzem significativamente os custos de saída e o consumo de tokens, como também já vêm com fortes capacidades de operar computadores, mirando de forma abrangente implantações em larga escala no nível corporativo.
(Histórico: Google anuncia desempenho “frozen” de chip totalmente novo com alta de 10 vezes! Valor de mercado da Alphabet dispara 1150 milhões de dólares)
(Complemento de contexto: Gemini 3.5 Pro travou por meses: disputas entre facções políticas dentro do Google frustraram os funcionários)

Sumário

Toggle

  • Gemini 3.6 Flash: salto expressivo de desempenho, com custo de saída menor
  • 3.5 Flash-Lite: ultra leve, disparando 350 tokens/s em alta velocidade
  • Focado em segurança na web, o pré-treinamento do Gemini 4 já começou

À medida que a tecnologia de inteligência artificial (AI) avança para a era agentic (orientada a agentes), o equilíbrio entre velocidade, custo e capacidade de raciocínio dos grandes modelos de linguagem se tornou uma consideração-chave para a adoção por empresas. No horário de Taipei em 21 de julho de 2026, o executivo sênior de gestão de produtos do Google, Tulsee Doshi, publicou um artigo oficial anunciando o lançamento de três novos modelos da série Flash, construídos com base nos feedbacks de usuários anteriores, fortalecendo ainda mais sua vantagem em infraestrutura para o segmento de agentes de IA.

Gemini 3.6 Flash: salto expressivo de desempenho, com custo de saída menor

Como principal modelo de trabalho da nova geração, o Gemini 3.6 Flash apresentou melhorias significativas no desempenho ao escrever código, em tarefas de conhecimento e em missões multimo­dais. Os dados mostram que o modelo atingiu uma pontuação alta de 83,0% no teste de capacidade de uso de computador (OSWorld-Verified), e as ferramentas relacionadas para uso de computador já estão diretamente integradas ao Gemini API e à versão empresarial.

Além disso, o 3.6 Flash otimizou bastante a eficiência do uso de tokens. De acordo com o Artificial Analysis Index, a quantidade de tokens de saída usada é 17% menor do que a de seu antecessor; em alguns testes de referência (como DeepSWE), a redução pode chegar a 65%. Isso não apenas diminui o tempo de raciocínio e as chamadas de ferramentas em fluxos de trabalho com várias etapas, como também torna o preço mais competitivo — entrada por US$ 1,50 por milhão de tokens e saída por US$ 7,50.

3.5 Flash-Lite: ultra leve, disparando 350 tokens/s em alta velocidade

Para tarefas que exigem baixa latência e alta taxa de transferência (por exemplo, busca de agentes e processamento de documentos), o Google lançou a versão dedicada Gemini 3.5 Flash-Lite. A velocidade de saída do modelo chega a 350 tokens por segundo, e o custo de entrada é extremamente baixo: apenas US$ 0,3 por milhão de tokens (saída por US$ 2,5).

Embora seja posicionado como um modelo leve, a qualidade do 3.5 Flash-Lite supera em muito a geração Lite anterior. Ele oferece níveis de “pensamento ajustáveis (thinking levels)”, permitindo que desenvolvedores alternem livremente entre um modo de baixo pensamento e um modo de alto pensamento para lidar com fluxos de trabalho complexos de subagentes. Em avaliações de codificação de agentes e contexto longo, ele até supera o modelo Gemini 3 Flash da versão padrão.

Focado em segurança na web, o pré-treinamento do Gemini 4 já começou

Nesta atualização, o Google também lançou o modelo “Gemini 3.5 Flash Cyber”, uma versão com fine-tuning do 3.5 Flash, voltada a cenários específicos de defesa em segurança. O modelo pode trabalhar em conjunto com um sistema multiagentes, o CodeMender, para gerar relatórios abrangentes, ajudando os defensores a identificar e corrigir rapidamente vulnerabilidades de segurança na web. No entanto, considerando o risco de dupla utilização dessa tecnologia, o acesso por enquanto é limitado, apenas por órgãos governamentais e parceiros confiáveis, por meio de programas-piloto com acesso restrito.

No fim do artigo, Doshi também deu pistas de que, além de estar testando com parceiros o Gemini 3.5 Pro, que deve ser lançado em breve de forma mais ampla, o Google já iniciou oficialmente o pré-treinamento do Gemini 4 e o descreveu como o “plano mais ambicioso” da empresa. A partir de agora, desenvolvedores já podem acessar os novos modelos 3.6 Flash e 3.5 Flash-Lite por vias como o Gemini API, para experimentar antecipadamente todo o potencial dos fluxos de trabalho de agentes de IA.

Ver original
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado