BackgroundImage

Comece a Conversar com Gemini 3.5 Flash

Use Gemini 3.5 Flash e toda a sua família de modelos, com mais mensagens todos os dias.

Gemini 3.5 Flash: Modelo rápido de nível de fronteira para agentes e programação

O Gemini 3.5 Flash é o modelo Flash estável do Google para inteligência de nível de fronteira com maior velocidade e menor custo em comparação com modelos flagship maiores. O Google o posiciona para execução agentiva, programação, tarefas de longo horizonte, fluxos de trabalho multi-etapas e aplicações escaláveis do mundo real.

O Gemini 3.5 Flash é destinado a desenvolvedores, equipes de produto, pesquisadores e empresas que precisam de raciocínio multimodal forte, ciclos rápidos de programação, uso de ferramentas e execução de longo contexto. Em comparação com o Gemini 3.1 Flash-Lite, ele oferece raciocínio mais profundo e maior capacidade agentiva; em comparação com o Gemini 3.1 Pro Preview, ele prioriza estabilidade de produção e velocidade da linha Flash.

Gemini 3.5 Flash: Especificações Principais

A seguir estão as principais especificações de Gemini 3.5 Flash e como elas impactam seu uso no mundo real.

  • Janela de contexto - 1.048.576 tokens de entrada: Esse limite de 1M tokens permite ao Gemini 3.5 Flash trabalhar com grandes bases de código, documentos longos, vídeos, PDFs e contexto de projetos de múltiplas fontes, útil para fluxos agentivos de longo horizonte.
  • Saída máxima - 65.536 tokens: Esse limite de saída suporta relatórios detalhados, respostas longas de código, planos estruturados e saídas de raciocínio extensas sem forçar divisão em múltiplas interações.
  • Velocidade e eficiência - Projetado para velocidade com inteligência de fronteira: O Gemini 3.5 Flash combina raciocínio avançado com responsividade da linha Flash, sendo adequado para ciclos rápidos de programação, subagentes e fluxos em escala.
  • Custo-benefício - $1,50 entrada e $9,00 saída por 1M tokens: O preço padrão torna o Gemini 3.5 Flash um modelo Flash premium, ideal para cargas de trabalho onde raciocínio mais forte, uso de ferramentas e contexto longo justificam o custo.
  • Capacidade de raciocínio - Thinking com níveis configuráveis: O Gemini 3.5 Flash suporta níveis de pensamento de mínimo até alto, permitindo equilibrar velocidade, custo e profundidade de raciocínio conforme a complexidade da tarefa.
  • Capacidades multimodais - Entrada de texto, imagem, vídeo, áudio e PDF com saída em texto: O modelo pode processar múltiplos tipos de entrada ao mesmo tempo, permitindo análise de documentos, compreensão de vídeos, raciocínio sobre áudio, inspeção visual e fluxos multimodais de pesquisa.

Comparar Gemini 3.5 Flash, Gemini 3.1 Pro Preview e Gemini 3.1 Flash-Lite

Uma visão geral rápida de como cada modelo difere em potência, velocidade e casos de uso.

RecursoGemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Flash-Lite
Knowledge Cutoff
Janeiro de 2025
Janeiro de 2025
Janeiro de 2025
Janela de contexto (tokens)
1.048.576 tokens de entrada
1.048.576 tokens de entrada
1.048.576 tokens de entrada
Tokens máximos de saída
65.536
65.536
65.536
Modalidades de Entrada
Texto, imagem, vídeo, áudio, PDF
Texto, imagem, vídeo, áudio, PDF
Texto, imagem, vídeo, áudio, PDF
Modalidades de Saída
Texto
Texto
Texto
Latência (Dados do OpenRouter)
Não oficialmente divulgado.
Não oficialmente divulgado.
Baixa latência
Velocidade
Rápido
Não oficialmente divulgado.
Rápido
Custo de entrada / saída por 1M de tokens
$1.50 / $9.00
$2.00 / $12.00 para prompts <=200K tokens; $4.00 / $18.00 para prompts >200K tokens
$0.25 texto/imagem/vídeo entrada ou $0.50 áudio entrada / $1.50 saída
Desempenho em Raciocínio
Avançado
Avançado
Prático
Desempenho em Programação
(no SWE-bench Verified)
55,1% no SWE-Bench Pro; 76,2% no Terminal-Bench 2.1
54,2% no SWE-Bench Pro; 70,3% no Terminal-Bench 2.1
Não oficialmente divulgado.
Melhor Para
programação agentiva, fluxos multi-etapas, raciocínio de longo contexto, tarefas multimodais e aplicações profissionais em escala
raciocínio multimodal avançado, engenharia de software, fluxos agentivos, uso de ferramentas e análise complexa
tarefas leves de alto volume, tradução, extração, roteamento, sumarização, processamento multimodal e fluxos agentivos econômicos

Fonte:  Google Gemini 3.5 Flash Documentation

Melhores Casos de Uso para Gemini 3.5 Flash

O Gemini 3.5 Flash é mais adequado para fluxos rápidos e complexos que exigem raciocínio avançado, suporte multimodal, uso de ferramentas e execução de longo contexto em escala.

  • Para desenvolvedores: Use o Gemini 3.5 Flash para ciclos rápidos de programação, depuração, geração de código, refatoração e tarefas de engenharia multi-etapas com iteração eficiente.
  • Para fluxos agentivos: Construa subagentes e sistemas multi-etapas que usam ferramentas, mantêm contexto de raciocínio, coordenam tarefas e executam fluxos de longo horizonte.
  • Para equipes de pesquisa: Analise documentos longos, PDFs, vídeos, áudio e arquivos estruturados juntos para produzir resumos, comparações e resultados técnicos confiáveis.
  • Para produtividade empresarial: Gere relatórios, processe grandes coleções de arquivos, resuma reuniões, revise documentos e suporte fluxos que exigem raciocínio profissional rápido.
  • Para análise multimodal: Combine texto, imagens, vídeo, áudio e PDFs em um único fluxo para revisão de documentos, compreensão de mídia e perguntas visuais.
  • Para aplicações com ferramentas: Use function calling, execução de código, busca, file search, saídas estruturadas e contexto de URL para construir aplicações mais ricas.

Como Acessar Gemini 3.5 Flash

O acesso ao Gemini 3.5 Flash é simples, seja via API oficial ou por uma interface de chat fácil de usar.

1. API oficial

Você pode acessar o Gemini 3.5 Flash pela API oficial do Gemini usando o ID gemini-3.5-flash. Ele suporta entradas multimodais, thinking, saídas estruturadas, function calling, execução de código, busca com grounding, file search, contexto de URL e opções de inferência batch, flex e priority.

2. EssayDone AI Chat

Se você quiser usar o Gemini 3.5 Flash sem configuração de API, o EssayDone AI Chat fornece acesso a este modelo por meio de uma interface de chat simples.

Essa opção é útil para usuários que querem suporte rápido para programação, escrita, pesquisa, análise multimodal, estudo e produtividade profissional sem configurar chaves de API ou ajustes técnicos.

FAQ

Aqui estão algumas perguntas frequentes sobre Gemini 3.5 Flash.

O Gemini 3.5 Flash é um modelo de raciocínio?

Sim. O Gemini 3.5 Flash suporta thinking e níveis configuráveis de pensamento, sendo adequado para programação, fluxos agentivos, raciocínio de longo contexto e tarefas multimodais complexas.

Quanto custa o Google Gemini 3.5 Flash?

O Gemini 3.5 Flash custa $1,50 por 1M tokens de entrada e $9,00 por 1M tokens de saída no preço padrão da API do Gemini. Preços batch e flex são menores, enquanto inferência priority é mais cara.

Para quais tarefas o Gemini 3.5 Flash é otimizado?

O Gemini 3.5 Flash é otimizado para programação agentiva, implantação de subagentes, fluxos multi-etapas rápidos, tarefas de longo horizonte, análise multimodal, trabalho com grounding de busca e aplicações em escala.

Quão bem o Gemini 3.5 Flash processa entradas multimodais?

O Gemini 3.5 Flash aceita entradas de texto, imagem, vídeo, áudio e PDF e produz saída em texto. Isso o torna útil para revisão de documentos, análise de vídeo, compreensão de áudio, raciocínio visual e fluxos multimodais de pesquisa.

Como o Gemini 3.5 Flash se compara ao Gemini 3.1 Pro Preview e ao Gemini 3.1 Flash-Lite?

Em comparação com o Gemini 3.1 Pro Preview, o Gemini 3.5 Flash é um modelo Flash estável com foco em velocidade e produção. Em comparação com o Gemini 3.1 Flash-Lite, ele é mais capaz em raciocínio complexo e programação agentiva, porém mais caro.

Qual é o benefício de usar o Gemini 3.5 Flash no EssayDone AI Chat?

Usar o Gemini 3.5 Flash no EssayDone AI Chat oferece uma forma simples de aplicar o modelo em programação, pesquisa, escrita e tarefas multimodais sem configurar a API oficial do Gemini.