Lançamento do Gemini 3.7 Flash
O Google DeepMind apresentou o Gemini 3.7 Flash, descrito como o modelo de trabalho mais inteligente até agora para codificação e agentes. O anúncio foi feito pelo diretor sênior de gestão de produtos em nome da equipe Gemini e segue apenas três semanas após o lançamento do Gemini 3.6 Flash.
Este novo lançamento é o resultado direto de sugestões de desenvolvedores e de inovações algorítmicas que a empresa planeja aplicar em modelos futuros. O 3.7 Flash oferece melhorias significativas em engenharia de software, trabalho baseado em conhecimento e fluxos de trabalho de desenvolvimento web. Seu preço introdutório corresponde a metade do custo original do 3.6 Flash por milhão de tokens.
No campo da codificação, o modelo demonstra avanços notáveis em tarefas como depuração e resolução de problemas. A precisão de código em primeira passagem aumentou e o sistema gera código pronto para produção com melhor desempenho, conforme medido em avaliações como FrontierCode 1.1 Main (43,6% contra 34,4%) e DeepSWE v1.1 (65,3% contra 49,0%).
No desenvolvimento web, o 3.7 Flash produz layouts mais funcionais e aplicativos completos em menos etapas de instrução. Sua capacidade de geração de interfaces de usuário mantém alta fidelidade a referências, sejam imagens, capturas de tela ou sistemas de design completos, superando o 3.6 Flash no WebDev Arena da Arena.ai com uma pontuação Elo de 1588 contra 1538.
Em áreas que exigem grande volume de informações, como finanças, direito e ciências biológicas, o modelo oferece raciocínio e precisão aprimorados. Ele alcança 34,0% contra 22,0% no teste GDP.pdf e 30,4% contra 17,0% no AutomationBench, superando o modelo anterior em ambos os casos.
Exemplos práticos incluem a criação de jogos 3D jogáveis a partir de uma simples descrição de texto, utilizando o Nano Banana para geração dinâmica de personagens, itens e texturas. Páginas de destino interativas e impressionantes são construídas em uma única etapa, com o Gemini 3.7 Flash orquestrando subagentes e utilizando o Gemini Omni para componentes de paralaxe suaves. Outros casos de uso abrangem treinamento de robôs via loops de agentes multimodais de três nós e a conversão de PDFs estáticos em histórias de dados interativas com gráficos ao vivo e insights agregados.
A experiência do desenvolvedor também evoluiu, com melhor adaptação a obstáculos, esclarecimento de intenções quando necessário e maior fidelidade no seguimento de instruções. O modelo realiza planejamento mais cuidadoso e chamadas de ferramentas mais disciplinadas, reduzindo a necessidade de intervenção manual e repetições em fluxos de trabalho de engenharia.
O Gemini 3.7 Flash estará disponível até o final do ano com preço introdutório de 0,75 dólares por milhão de tokens de entrada e 3,75 dólares por milhão de tokens de saída. Essa combinação de desempenho aprimorado e custo acessível permite que empresas e desenvolvedores expandam o uso de agentes prontos para produção sem impacto financeiro excessivo. A integração com o Gemini Spark, já utilizada por assinantes do Google AI Pro e Ultra em mais de 160 países, eleva a eficiência em tarefas de conhecimento, melhorando o uso de ferramentas em aplicativos do Google Workspace e aprimorando a qualidade das saídas em fluxos de trabalho complexos e multitarefa.
Além disso, o modelo inclui salvaguardas atualizadas contra usos indevidos em áreas como ameaças químicas, biológicas, radiológicas, nucleares e ofensivas cibernéticas, mantendo o apoio a aplicações benéficas em consonância com iniciativas de bioresiliência e programas de segurança cibernética da empresa.
Com informações de: Google DeepMind