Google: Gemini 3.7 Flash

Chat-50%
google/gemini-3.7-flash

O Gemini 3.7 Flash é o modelo multimodal de trabalho do Google para fluxos de trabalho agênticos rápidos, programação e raciocínio complexo em várias etapas, lançado em 2026-08-13 e com melhorias em relação ao Gemini 3.6 Flash em benchmarks agênticos como GPQA Diamond (~94%) e TAU-Bench (~80%). É um modelo de raciocínio com níveis configuráveis que aceita todas as modalidades de entrada — texto, imagem, vídeo e áudio. Oferece visão, uso de ferramentas, cache de prompts, entrada de PDF e busca na web. Janela de contexto: 1M tokens, saída: 64K. Disponível pelos protocolos OpenAI e Gemini.

Janela de Contexto
1M
Tokens Máx de Saída
66K
Lançamento
2026-08-13
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de ÁudioEntrada de VídeoEntrada PDF
Provedores Disponíveis
Vertex
Protocolos Suportados
openaigemini

Providers

Vertex
-50%
Tokens de Entrada
$0.75/M
$1.5/M
Tokens de Saída
$3.75/M
$7.5/M
Leitura de Cache
$0.075/M
$0.15/M
Escrita de Cache
$0.0415/M
$0.083/M
Entrada de Áudio
$0.75/M
$1.5/M
Escrita de Cache (1 hora)
$0.5/M
$1/M
Áudio em Cache
$0.075/M
$0.15/M
Busca Web
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Exemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.7-flash",
contents="Hello!",
)
print(response.text)

Disponibilidade e status

Perguntas Frequentes

Google: Gemini 3.7 Flash na Ofox.ai custa $1.5/M por milhão de tokens de entrada e $7.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.