Google lança Gemini 3.1 Flash-Lite: IA rápida e acessível
-
Maicon Ramos
- 3 minutos de leitura
Navegue por tópicos
O Google apresentou o Gemini 3.1 Flash-Lite, um modelo de IA que une rapidez, custo reduzido e inteligência competitiva para tarefas de alto volume.
- Modelo multimodal nativo suporta texto, imagem, áudio, vídeo e PDFs.
- Velocidade 2.5x maior e 12 pontos a mais no índice de inteligência comparado ao predecessor.
- Preço acessível: US$ 0,25 por milhão de tokens de input e US$ 1,50 por milhão de tokens de output.
- Disponível globalmente via Google AI Studio, Vertex AI e Gemini API em preview desde março de 2026.
Google lançou em março de 2026 o Gemini 3.1 Flash-Lite, seu modelo de inteligência artificial mais rápido e econômico da linha Gemini 3, projetado para aplicações com grandes volumes de dados e custos reduzidos.
Características principais
- O Gemini 3.1 Flash-Lite é um modelo multimodal nativo que aceita inputs em texto, imagem, áudio, vídeo e PDFs, atendendo demandas diversas de desenvolvedores.
- Oferece uma velocidade de saída de 379,6 tokens por segundo, 2,5 vezes mais rápida que seu predecessor, e um índice de inteligência 12 pontos superior, garantindo respostas rápidas e raciocínio aprimorado.
- Suporta janelas de contexto longas, com até 1 milhão de tokens para input e até 65 mil tokens para output, ideal para tarefas que exigem grandes volumes de dados.
- Tem preço competitivo, custando US$ 0,25 por 1 milhão de tokens de input e US$ 1,50 por 1 milhão de tokens de output, representando cerca de 1/8 do custo do modelo 3.1 Pro da mesma série.
Onde e como acessar
- O modelo está disponível em preview para desenvolvedores e empresas por meio do Google AI Studio, Vertex AI e Gemini API.
- Empresas como Latitude, Cartwheel e Whering estão entre os pilotos que já utilizam a tecnologia para aplicações de alta escala.
Capacidades técnicas detalhadas
- Suporte a até 3.000 imagens por prompt, arquivos de até 7 MB embutidos e até 30 MB via Cloud Storage.
- Reconhecimento e processamento de até 3.000 documentos com até 50 MB por arquivo, incluindo PDFs e textos de até 1.000 páginas.
- Capacidade para analisar vídeos de até 45 minutos com áudio ou 1 hora sem áudio, e áudios de até 8,4 horas ou 1 milhão de tokens.
- Formatação e reconhecimento multimídia suportados para PNG, JPEG, WebP, MP4, WebM, MP3, WAV e PDFs.
Limitações e críticas
- Embora rápido e acessível, o Gemini 3.1 Flash-Lite é menos capaz que o modelo Pro em tarefas complexas e técnicas profundas.
- Tempo para a primeira resposta (TTFT) de 5,33 segundos é relativamente alto para a categoria, podendo ser um fator limitante para aplicações de latência ultra baixa.
- Limitação de conhecimento até janeiro de 2025, não contemplando eventos posteriores.
- Ausência de capacidades como geração de imagens e uso computacional, restringindo o escopo para algumas aplicações avançadas.
Impactos no mercado
- Dirigido a desenvolvedores de alto volume que precisam de soluções econômicas e eficientes, facilitando a entrada de pequenas e médias empresas no uso de IA avançada.
- Pressiona concorrentes no segmento de IA acessível, como o OpenAI GPT-4o mini, com custo e velocidade competitivos.
- Reforça o domínio do Google em inteligência artificial na nuvem, especialmente via Vertex AI, sua plataforma de AI para empresas.
Mídia oficial
Confira o vídeo oficial do lançamento do Gemini 3.1 Flash-Lite no canal oficial do Google no YouTube:
O Google detalha a novidade em seu blog oficial: Leia mais no blog do Google.
Maicon Ramos
Infoprodutor e especialista em automações de Marketing, fundador do Automação sem Limites, uma comunidade para ajudar empreendedores e startup.














