Google lança Gemini 3.1 Flash-Lite: IA rápida e acessível

Google lança Gemini 3.1 Flash-Lite: IA rápida e acessível

Navegue por tópicos

O Google apresentou o Gemini 3.1 Flash-Lite, um modelo de IA que une rapidez, custo reduzido e inteligência competitiva para tarefas de alto volume.

  • Modelo multimodal nativo suporta texto, imagem, áudio, vídeo e PDFs.
  • Velocidade 2.5x maior e 12 pontos a mais no índice de inteligência comparado ao predecessor.
  • Preço acessível: US$ 0,25 por milhão de tokens de input e US$ 1,50 por milhão de tokens de output.
  • Disponível globalmente via Google AI Studio, Vertex AI e Gemini API em preview desde março de 2026.

Google lançou em março de 2026 o Gemini 3.1 Flash-Lite, seu modelo de inteligência artificial mais rápido e econômico da linha Gemini 3, projetado para aplicações com grandes volumes de dados e custos reduzidos.

Características principais

  • O Gemini 3.1 Flash-Lite é um modelo multimodal nativo que aceita inputs em texto, imagem, áudio, vídeo e PDFs, atendendo demandas diversas de desenvolvedores.
  • Oferece uma velocidade de saída de 379,6 tokens por segundo, 2,5 vezes mais rápida que seu predecessor, e um índice de inteligência 12 pontos superior, garantindo respostas rápidas e raciocínio aprimorado.
  • Suporta janelas de contexto longas, com até 1 milhão de tokens para input e até 65 mil tokens para output, ideal para tarefas que exigem grandes volumes de dados.
  • Tem preço competitivo, custando US$ 0,25 por 1 milhão de tokens de input e US$ 1,50 por 1 milhão de tokens de output, representando cerca de 1/8 do custo do modelo 3.1 Pro da mesma série.

Onde e como acessar

  • O modelo está disponível em preview para desenvolvedores e empresas por meio do Google AI Studio, Vertex AI e Gemini API.
  • Empresas como Latitude, Cartwheel e Whering estão entre os pilotos que já utilizam a tecnologia para aplicações de alta escala.

Capacidades técnicas detalhadas

  • Suporte a até 3.000 imagens por prompt, arquivos de até 7 MB embutidos e até 30 MB via Cloud Storage.
  • Reconhecimento e processamento de até 3.000 documentos com até 50 MB por arquivo, incluindo PDFs e textos de até 1.000 páginas.
  • Capacidade para analisar vídeos de até 45 minutos com áudio ou 1 hora sem áudio, e áudios de até 8,4 horas ou 1 milhão de tokens.
  • Formatação e reconhecimento multimídia suportados para PNG, JPEG, WebP, MP4, WebM, MP3, WAV e PDFs.

Limitações e críticas

  • Embora rápido e acessível, o Gemini 3.1 Flash-Lite é menos capaz que o modelo Pro em tarefas complexas e técnicas profundas.
  • Tempo para a primeira resposta (TTFT) de 5,33 segundos é relativamente alto para a categoria, podendo ser um fator limitante para aplicações de latência ultra baixa.
  • Limitação de conhecimento até janeiro de 2025, não contemplando eventos posteriores.
  • Ausência de capacidades como geração de imagens e uso computacional, restringindo o escopo para algumas aplicações avançadas.

Impactos no mercado

  • Dirigido a desenvolvedores de alto volume que precisam de soluções econômicas e eficientes, facilitando a entrada de pequenas e médias empresas no uso de IA avançada.
  • Pressiona concorrentes no segmento de IA acessível, como o OpenAI GPT-4o mini, com custo e velocidade competitivos.
  • Reforça o domínio do Google em inteligência artificial na nuvem, especialmente via Vertex AI, sua plataforma de AI para empresas.

Mídia oficial

Confira o vídeo oficial do lançamento do Gemini 3.1 Flash-Lite no canal oficial do Google no YouTube:

O Google detalha a novidade em seu blog oficial: Leia mais no blog do Google.

Foto de Maicon Ramos

Maicon Ramos

Infoprodutor e especialista em automações de Marketing, fundador do Automação sem Limites, uma comunidade para ajudar empreendedores e startup.