

Comece a Conversar com Gemini 3.5 Flash
Use Gemini 3.5 Flash e toda a sua família de modelos, com mais mensagens todos os dias.
Gemini 3.5 Flash: Modelo rápido de nível de fronteira para agentes e programação
O Gemini 3.5 Flash é o modelo Flash estável do Google para inteligência de nível de fronteira com maior velocidade e menor custo em comparação com modelos flagship maiores. O Google o posiciona para execução agentiva, programação, tarefas de longo horizonte, fluxos de trabalho multi-etapas e aplicações escaláveis do mundo real.
O Gemini 3.5 Flash é destinado a desenvolvedores, equipes de produto, pesquisadores e empresas que precisam de raciocínio multimodal forte, ciclos rápidos de programação, uso de ferramentas e execução de longo contexto. Em comparação com o Gemini 3.1 Flash-Lite, ele oferece raciocínio mais profundo e maior capacidade agentiva; em comparação com o Gemini 3.1 Pro Preview, ele prioriza estabilidade de produção e velocidade da linha Flash.
Gemini 3.5 Flash: Especificações Principais
A seguir estão as principais especificações de Gemini 3.5 Flash e como elas impactam seu uso no mundo real.
- Janela de contexto - 1.048.576 tokens de entrada: Esse limite de 1M tokens permite ao Gemini 3.5 Flash trabalhar com grandes bases de código, documentos longos, vídeos, PDFs e contexto de projetos de múltiplas fontes, útil para fluxos agentivos de longo horizonte.
- Saída máxima - 65.536 tokens: Esse limite de saída suporta relatórios detalhados, respostas longas de código, planos estruturados e saídas de raciocínio extensas sem forçar divisão em múltiplas interações.
- Velocidade e eficiência - Projetado para velocidade com inteligência de fronteira: O Gemini 3.5 Flash combina raciocínio avançado com responsividade da linha Flash, sendo adequado para ciclos rápidos de programação, subagentes e fluxos em escala.
- Custo-benefício - $1,50 entrada e $9,00 saída por 1M tokens: O preço padrão torna o Gemini 3.5 Flash um modelo Flash premium, ideal para cargas de trabalho onde raciocínio mais forte, uso de ferramentas e contexto longo justificam o custo.
- Capacidade de raciocínio - Thinking com níveis configuráveis: O Gemini 3.5 Flash suporta níveis de pensamento de mínimo até alto, permitindo equilibrar velocidade, custo e profundidade de raciocínio conforme a complexidade da tarefa.
- Capacidades multimodais - Entrada de texto, imagem, vídeo, áudio e PDF com saída em texto: O modelo pode processar múltiplos tipos de entrada ao mesmo tempo, permitindo análise de documentos, compreensão de vídeos, raciocínio sobre áudio, inspeção visual e fluxos multimodais de pesquisa.
Comparar Gemini 3.5 Flash, Gemini 3.1 Pro Preview e Gemini 3.1 Flash-Lite
Uma visão geral rápida de como cada modelo difere em potência, velocidade e casos de uso.
| Recurso | Gemini 3.5 Flash | Gemini 3.1 Pro Preview | Gemini 3.1 Flash-Lite |
|---|---|---|---|
| Knowledge Cutoff | Janeiro de 2025 | Janeiro de 2025 | Janeiro de 2025 |
| Janela de contexto (tokens) | 1.048.576 tokens de entrada | 1.048.576 tokens de entrada | 1.048.576 tokens de entrada |
| Tokens máximos de saída | 65.536 | 65.536 | 65.536 |
| Modalidades de Entrada | Texto, imagem, vídeo, áudio, PDF | Texto, imagem, vídeo, áudio, PDF | Texto, imagem, vídeo, áudio, PDF |
| Modalidades de Saída | Texto | Texto | Texto |
| Latência (Dados do OpenRouter) | Não oficialmente divulgado. | Não oficialmente divulgado. | Baixa latência |
| Velocidade | Rápido | Não oficialmente divulgado. | Rápido |
| Custo de entrada / saída por 1M de tokens | $1.50 / $9.00 | $2.00 / $12.00 para prompts <=200K tokens; $4.00 / $18.00 para prompts >200K tokens | $0.25 texto/imagem/vídeo entrada ou $0.50 áudio entrada / $1.50 saída |
| Desempenho em Raciocínio | Avançado | Avançado | Prático |
| Desempenho em Programação (no SWE-bench Verified) | 55,1% no SWE-Bench Pro; 76,2% no Terminal-Bench 2.1 | 54,2% no SWE-Bench Pro; 70,3% no Terminal-Bench 2.1 | Não oficialmente divulgado. |
| Melhor Para | programação agentiva, fluxos multi-etapas, raciocínio de longo contexto, tarefas multimodais e aplicações profissionais em escala | raciocínio multimodal avançado, engenharia de software, fluxos agentivos, uso de ferramentas e análise complexa | tarefas leves de alto volume, tradução, extração, roteamento, sumarização, processamento multimodal e fluxos agentivos econômicos |
Melhores Casos de Uso para Gemini 3.5 Flash
O Gemini 3.5 Flash é mais adequado para fluxos rápidos e complexos que exigem raciocínio avançado, suporte multimodal, uso de ferramentas e execução de longo contexto em escala.
- Para desenvolvedores: Use o Gemini 3.5 Flash para ciclos rápidos de programação, depuração, geração de código, refatoração e tarefas de engenharia multi-etapas com iteração eficiente.
- Para fluxos agentivos: Construa subagentes e sistemas multi-etapas que usam ferramentas, mantêm contexto de raciocínio, coordenam tarefas e executam fluxos de longo horizonte.
- Para equipes de pesquisa: Analise documentos longos, PDFs, vídeos, áudio e arquivos estruturados juntos para produzir resumos, comparações e resultados técnicos confiáveis.
- Para produtividade empresarial: Gere relatórios, processe grandes coleções de arquivos, resuma reuniões, revise documentos e suporte fluxos que exigem raciocínio profissional rápido.
- Para análise multimodal: Combine texto, imagens, vídeo, áudio e PDFs em um único fluxo para revisão de documentos, compreensão de mídia e perguntas visuais.
- Para aplicações com ferramentas: Use function calling, execução de código, busca, file search, saídas estruturadas e contexto de URL para construir aplicações mais ricas.
Como Acessar Gemini 3.5 Flash
O acesso ao Gemini 3.5 Flash é simples, seja via API oficial ou por uma interface de chat fácil de usar.
1. API oficial
Você pode acessar o Gemini 3.5 Flash pela API oficial do Gemini usando o ID gemini-3.5-flash. Ele suporta entradas multimodais, thinking, saídas estruturadas, function calling, execução de código, busca com grounding, file search, contexto de URL e opções de inferência batch, flex e priority.
2. EssayDone AI Chat
Se você quiser usar o Gemini 3.5 Flash sem configuração de API, o EssayDone AI Chat fornece acesso a este modelo por meio de uma interface de chat simples.
Essa opção é útil para usuários que querem suporte rápido para programação, escrita, pesquisa, análise multimodal, estudo e produtividade profissional sem configurar chaves de API ou ajustes técnicos.
Explore Mais Modelos de AI
Encontre o modelo que você precisa — pesquise ou selecione para abrir seu perfil completo.
19 modelos disponíveis
FAQ
Aqui estão algumas perguntas frequentes sobre Gemini 3.5 Flash.
Sim. O Gemini 3.5 Flash suporta thinking e níveis configuráveis de pensamento, sendo adequado para programação, fluxos agentivos, raciocínio de longo contexto e tarefas multimodais complexas.
O Gemini 3.5 Flash custa $1,50 por 1M tokens de entrada e $9,00 por 1M tokens de saída no preço padrão da API do Gemini. Preços batch e flex são menores, enquanto inferência priority é mais cara.
O Gemini 3.5 Flash é otimizado para programação agentiva, implantação de subagentes, fluxos multi-etapas rápidos, tarefas de longo horizonte, análise multimodal, trabalho com grounding de busca e aplicações em escala.
O Gemini 3.5 Flash aceita entradas de texto, imagem, vídeo, áudio e PDF e produz saída em texto. Isso o torna útil para revisão de documentos, análise de vídeo, compreensão de áudio, raciocínio visual e fluxos multimodais de pesquisa.
Em comparação com o Gemini 3.1 Pro Preview, o Gemini 3.5 Flash é um modelo Flash estável com foco em velocidade e produção. Em comparação com o Gemini 3.1 Flash-Lite, ele é mais capaz em raciocínio complexo e programação agentiva, porém mais caro.
Usar o Gemini 3.5 Flash no EssayDone AI Chat oferece uma forma simples de aplicar o modelo em programação, pesquisa, escrita e tarefas multimodais sem configurar a API oficial do Gemini.