Recentes
BNDES aprova linha de crédito de até R$ 8 bilhões para companhias aéreas Huawei lança FreeClip 2 S ao lado de Isis Valverde Reforma Tributária: agosto marca nova fase de adequação Conceito de moradia superluxo tem novas exigências Projeta Cultura tem formação gratuita em gestão cultural Brasil ultrapassa 300 Centros de Serviços Compartilhados Estudo de 2026 revela aumento nas perdas de água potável Startup aposta no setor de serviços para enfrentar um dos maiores gargalos da economia brasileira Apartamentos compactos impulsionam demanda por self storage PC BA publica edital de Delegado; salário chega R$ 16,4 mil BNDES aprova linha de crédito de até R$ 8 bilhões para companhias aéreas Huawei lança FreeClip 2 S ao lado de Isis Valverde Reforma Tributária: agosto marca nova fase de adequação Conceito de moradia superluxo tem novas exigências Projeta Cultura tem formação gratuita em gestão cultural Brasil ultrapassa 300 Centros de Serviços Compartilhados Estudo de 2026 revela aumento nas perdas de água potável Startup aposta no setor de serviços para enfrentar um dos maiores gargalos da economia brasileira Apartamentos compactos impulsionam demanda por self storage PC BA publica edital de Delegado; salário chega R$ 16,4 mil BNDES aprova linha de crédito de até R$ 8 bilhões para companhias aéreas Huawei lança FreeClip 2 S ao lado de Isis Valverde Reforma Tributária: agosto marca nova fase de adequação Conceito de moradia superluxo tem novas exigências Projeta Cultura tem formação gratuita em gestão cultural Brasil ultrapassa 300 Centros de Serviços Compartilhados Estudo de 2026 revela aumento nas perdas de água potável Startup aposta no setor de serviços para enfrentar um dos maiores gargalos da economia brasileira Apartamentos compactos impulsionam demanda por self storage PC BA publica edital de Delegado; salário chega R$ 16,4 mil BNDES aprova linha de crédito de até R$ 8 bilhões para companhias aéreas Huawei lança FreeClip 2 S ao lado de Isis Valverde Reforma Tributária: agosto marca nova fase de adequação Conceito de moradia superluxo tem novas exigências Projeta Cultura tem formação gratuita em gestão cultural Brasil ultrapassa 300 Centros de Serviços Compartilhados Estudo de 2026 revela aumento nas perdas de água potável Startup aposta no setor de serviços para enfrentar um dos maiores gargalos da economia brasileira Apartamentos compactos impulsionam demanda por self storage PC BA publica edital de Delegado; salário chega R$ 16,4 mil
Empresas

Google lança Gemini 3.6 Flash com foco em agentes de IA mais eficientes

29/07/2026 • 14:41

Profissional usa ferramenta de inteligência artificial para analisar dados
Ouvir materia voz de IA no navegador

Nova família de modelos combina menor uso de tokens, preços reduzidos e ferramentas para automação, enquanto uma versão especializada em cibersegurança será limitada a governos e parceiros confiáveis.

O Google anunciou o Gemini 3.6 Flash e o Gemini 3.5 Flash-Lite, modelos voltados a empresas e desenvolvedores que precisam operar agentes de inteligência artificial em escala. A principal promessa é reduzir o custo de cada tarefa sem abrir mão de qualidade, velocidade e capacidade de usar ferramentas. A companhia também apresentou o Gemini 3.5 Flash Cyber, versão especializada em encontrar, validar e corrigir vulnerabilidades de software, que será oferecida inicialmente em um programa de acesso restrito.

Para empreendedores, a atualização reforça uma mudança importante no mercado de IA generativa: a competição está saindo da comparação isolada de respostas e avançando para o custo total de processos automatizados. Um agente pode consultar documentos, executar código, acionar sistemas e revisar resultados em várias etapas. Por isso, preço por token, quantidade de chamadas e eficiência do raciocínio passam a influenciar diretamente a viabilidade econômica de um produto.

Gemini 3.6 Flash busca reduzir o custo dos agentes

Segundo o Google, o Gemini 3.6 Flash usa 17% menos tokens de saída do que o 3.5 Flash em uma avaliação citada pela empresa. O modelo também foi projetado para realizar menos etapas de raciocínio e menos chamadas de ferramentas em fluxos de várias fases. Para clientes, essa combinação pode reduzir tanto a conta da API quanto o tempo necessário para concluir tarefas.

O preço informado é de US$ 1,50 por 1 milhão de tokens de entrada e US$ 7,50 por 1 milhão de tokens de saída. A entrada corresponde, de forma simplificada, ao contexto enviado ao modelo — instruções, documentos e dados —, enquanto a saída é o conteúdo gerado. Em operações com grande volume, pequenas diferenças nesses componentes podem alterar significativamente a margem de uma startup ou o orçamento de automação de uma empresa.

O Google também divulgou avanços em programação, pesquisa de aprendizado de máquina, uso de computador e trabalho com conhecimento. Na avaliação DeepSWE citada no anúncio oficial, o resultado passou de 37% no 3.5 Flash para 49% no 3.6 Flash. No OSWorld-Verified, usado para medir tarefas em interfaces de computador, a pontuação informada subiu de 78,4% para 83%.

Esses números precisam ser avaliados no contexto de cada aplicação. Benchmarks ajudam a comparar modelos, mas não substituem testes com dados, ferramentas e critérios do negócio. Uma empresa que pretende automatizar análise de documentos, atendimento ou rotinas financeiras deve medir precisão, latência, custo por tarefa concluída e necessidade de revisão humana.

Flash-Lite atende operações de alto volume

O Gemini 3.5 Flash-Lite ocupa a faixa de menor custo e maior velocidade da família. O modelo foi desenvolvido para atividades como pesquisa com agentes, processamento de documentos, tradução, extração de informações e outras rotinas que recebem grande quantidade de solicitações. O preço anunciado é de US$ 0,30 por 1 milhão de tokens de entrada e US$ 2,50 por 1 milhão de tokens de saída.

De acordo com o Google, o Flash-Lite alcança 350 tokens de saída por segundo em uma medição mencionada no anúncio. A empresa afirma ainda que o modelo possui níveis de raciocínio configuráveis. Assim, desenvolvedores podem priorizar menor latência e custo em tarefas simples ou permitir mais processamento em etapas que exigem planejamento e uso de subagentes.

Essa segmentação permite criar arquiteturas em que modelos diferentes executam papéis distintos. Um sistema pode usar a opção mais barata para classificar e resumir documentos, encaminhar casos complexos ao Gemini 3.6 Flash e reservar revisão humana para decisões de maior risco. A lógica se aproxima da escolha de infraestrutura especializada que já aparece em serviços de nuvem e em iniciativas com chips dedicados à inteligência artificial.

O que muda para empresas e startups

O primeiro impacto é financeiro. Negócios que vendem software com IA precisam acompanhar o custo unitário de cada fluxo, e não apenas o preço nominal do modelo. Um agente que produz menos tokens, usa menos ferramentas e conclui mais tarefas na primeira tentativa pode ser mais econômico mesmo quando a tarifa de uma chamada individual não é a menor do mercado.

O segundo impacto é operacional. Modelos mais rápidos tornam viáveis experiências em tempo real, como suporte ao cliente, pesquisa em bases corporativas e assistência dentro de aplicativos. Já modelos eficientes para documentos podem ajudar departamentos jurídicos, financeiros e comerciais a organizar informações, desde que existam controles de acesso, trilhas de auditoria e políticas para dados sensíveis.

Para startups, a nova família amplia as opções para prototipar e escalar produtos sem manter infraestrutura própria de modelos. Esse movimento é semelhante ao que ocorre em parcerias que buscam democratizar a IA generativa no desenvolvimento de software. A vantagem competitiva, porém, tende a vir menos do acesso ao modelo e mais da qualidade dos dados, da integração com processos e da experiência entregue ao usuário.

Gemini 3.5 Flash Cyber foca segurança de software

O terceiro modelo anunciado é o Gemini 3.5 Flash Cyber, ajustado para localizar, validar e corrigir vulnerabilidades. Ele será usado com o CodeMender, agente de segurança de código do Google. A empresa informa que múltiplos agentes podem analisar diferentes caminhos de execução e consolidar um único relatório, uma estratégia destinada a ampliar a cobertura sem depender de uma única chamada a um modelo maior.

No anúncio oficial, o Google afirma que o sistema encontrou 55 vulnerabilidades únicas no mecanismo JavaScript V8 durante uma avaliação com número fixo de chamadas. A versão principal do Gemini 3.5 Flash encontrou 47, e outro modelo comparado encontrou 36. A companhia também relata que o Flash Cyber já é usado internamente em bases de código ligadas a Chrome, Android, Cloud, Ads e YouTube.

Por ser uma tecnologia de uso duplo, capaz de ajudar defensores e também de ampliar riscos se mal utilizada, o acesso será controlado. O Gemini 3.5 Flash Cyber deverá chegar primeiro a governos e parceiros confiáveis por meio do CodeMender, em um piloto limitado. Para empresas, o anúncio sinaliza que segurança automatizada tende a se tornar parte contínua do desenvolvimento, com varreduras frequentes e correções integradas ao ciclo de software.

Disponibilidade e cuidados na adoção

O Gemini 3.6 Flash e o 3.5 Flash-Lite estão disponíveis para desenvolvedores pela API Gemini no Google AI Studio e no Android Studio. O 3.6 Flash também aparece no Google Antigravity. Para empresas, os modelos podem ser usados na Gemini Enterprise Agent Platform, e o 3.6 Flash está disponível no aplicativo Gemini Enterprise. O Google informou ainda que o Flash-Lite começou a chegar à Busca.

Antes de migrar, organizações devem comparar o desempenho em seus próprios casos de uso. Um piloto responsável inclui um conjunto representativo de tarefas, critérios claros de qualidade, medição de custo por resultado, testes de segurança e um plano de retorno caso a atualização produza comportamentos inesperados. Também é importante verificar termos de uso, localização de dados e requisitos regulatórios.

A página oficial do Google reúne preços, disponibilidade e resultados divulgados para os três modelos. Para investidores e empreendedores, o sinal mais relevante é a rápida redução do custo de agentes capazes de executar tarefas complexas. Isso tende a estimular novas aplicações, mas também aumenta a necessidade de governança, diferenciação de produto e avaliação rigorosa do retorno sobre investimento.