Gemini 2.0 Flash

O Gemini 2.0 Flash oferece recursos de última geração e capacidades aprimoradas projetadas para a era agêntica, incluindo velocidade superior, uso de ferramentas integradas, geração multimodal e uma janela de contexto de 1 milhão de tokens. O Gemini 2.0 Flash melhora nosso modelo Flash anterior e oferece qualidade aprimorada em velocidades semelhantes.

Testar na visualização do Agent Studio no Model Garden Implantar um app de exemplo Ver preços

Observação: "Implantar um app de exemplo" exige um projeto na nuvem do Google Cloud com o faturamento e a API Agent Platform ativados.
ID do modelo gemini-2.0-flash
Modalidades
Texto Entrada e saída
Imagem Somente entrada
Áudio Somente entrada
Vídeo Somente entrada
Limites de tokens Janela de contexto 1.048.576
Máximo de tokens de saída 65.536
Recursos
Ferramentas
Opções de consumo
Limite de tamanho da entrada 500 MB
Especificações técnicas Imagem
  • Número máximo de imagens por solicitação: 3.000
  • Tamanho máximo do arquivo para dados inline ou uploads diretos pelo console: 7 MB
  • Tamanho máximo do arquivo do Google Cloud Storage: 30 MB
  • Número máximo de tokens por minuto (TPM) por projeto:
    • Resolução de mídia alta/média/padrão:
      • EUA/Ásia: 40 milhões
      • UE: 10 milhões
    • Resolução de mídia baixa:
      • EUA/Ásia: 10 milhões
      • UE: 2,6 milhões
  • Tipos MIME compatíveis:
    image/png, image/jpeg, image/webp, image/heic, image/heif
Texto
  • Número máximo de arquivos por solicitação: 3.000
  • Número máximo de páginas por arquivo: 1.000
  • Tamanho máximo do arquivo para importações da API ou do Cloud Storage: 50 MB(application/pdf) ou 7 MB(text/plain)
  • Tamanho máximo do arquivo por arquivo para uploads diretos pelo console: 7 MB
  • Número máximo de tokens por minuto (TPM) por projeto1:
    • EUA/Ásia: 3,4 milhões
    • UE: 3,4 milhões
  • Tipos MIME compatíveis:
    application/pdf, text/plain
Vídeo
  • Duração máxima do vídeo (com áudio): aproximadamente 45 minutos
  • Duração máxima do vídeo (sem áudio): aproximadamente 1 hora
  • Número máximo de vídeos por solicitação: 10
  • Número máximo de tokens por minuto (TPM):
    • Resolução de mídia alta/média/padrão:
      • EUA/Ásia: 38 milhões
      • UE: 10 milhões
    • Resolução de mídia baixa:
      • EUA/Ásia: 10 milhões
      • UE: 2,5 milhões
  • Tipos MIME compatíveis:
    video/x-flv, video/quicktime, video/mpeg, video/mpegs, video/mpg, video/mp4, video/webm, video/wmv, video/3gpp
Áudio
  • Duração máxima do áudio por solicitação: aproximadamente 8, 4 horas ou até 1 milhão de tokens
  • Número máximo de arquivos de áudio por solicitação: 1
  • Entendimento de fala para: resumo, transcrição e tradução de áudio
  • Número máximo de tokens por minuto (TPM):
    • EUA/Ásia: 3,5 milhões
    • UE: 3,5 milhões
  • Tipos MIME compatíveis:
    audio/x-aac, audio/flac, audio/mp3, audio/m4a, audio/mpeg, audio/mpga, audio/mp4, audio/ogg, audio/pcm, audio/wav, audio/webm
Padrões de parâmetros
  • Temperatura: 0,0 a 2,0 (padrão 1,0)
  • topP: 0,0 a 1,0 (padrão 0,95)
  • topK: 64 (fixo)
  • candidateCount: 1 a 8 (padrão 1)
Regiões compatíveis

Disponibilidade do modelo

  • Global: global
  • Estados Unidos: us-central1, us-east1, us-east4, us-east5, us-south1, us-west1, us-west4
  • Europa: europe-central2, europe-north1, europe-southwest1, europe-west1, europe-west4, europe-west8, europe-west9

Processamento de ML

Versões
  • gemini-2.0-flash-001
    • Etapa de lançamento: descontinuado
    • Data de lançamento: 5 de fevereiro de 2025
    • Data de desativação: 1º de junho de 2026