Gemini

Google: Gemini 3.5 Flash Lite

Chat
google/gemini-3.5-flash-lite
CompararComeçar

O Gemini 3.5 Flash Lite é o modelo multimodal de alta taxa de processamento e baixa latência do Google com capacidades agênticas aprimoradas, lançado em 2026-07-21 como sucessor do Gemini 3.1 Flash Lite. Ele é voltado a subagentes que executam tarefas específicas dentro de fluxos de trabalho multiagente complexos, além de busca agêntica e processamento de documentos. Todas as modalidades de entrada — texto, imagem, vídeo e áudio — são unificadas em $0.30/M tokens, com um nível em lote com 50% de desconto. Oferece raciocínio, uso de ferramentas, cache de prompts, entrada de PDF e busca na web. Janela de contexto: 1M tokens, saída: 64K. Disponível pelos protocolos OpenAI e Gemini.

Janela de Contexto
1M
Tokens Máx de Saída
66K
Lançamento
2026-07-21
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de ÁudioEntrada de VídeoEntrada PDF
Provedores Disponíveis
GoogleCloudVertex
Protocolos Suportados
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Tokens de Entrada
$0.3/M
Tokens de Saída
$2.5/M
Leitura de Cache
$0.03/M
Escrita de Cache
$0.083/M
Entrada de Áudio
$0.3/M
Escrita de Cache (1 hora)
$1/M
Áudio em Cache
$0.03/M
Busca Web
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Exemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.5-flash-lite",
contents="Hello!",
)
print(response.text)

Perguntas Frequentes

Google: Gemini 3.5 Flash Lite na Ofox.ai custa $0.3/M por milhão de tokens de entrada e $2.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.