Gemini

Google: Gemini 3.6 Flash

Chat
google/gemini-3.6-flash
CompararComeçar

O Gemini 3.6 Flash é o modelo de trabalho do Google focado em eficiência de tokens, lançado em 2026-07-21. Ele produz 17% menos tokens de saída que o Gemini 3.5 Flash, precisa de menos etapas de raciocínio e chamadas de ferramentas em fluxos de trabalho agênticos de várias etapas e faz edições de código mais precisas com menos laços de execução. É um modelo de raciocínio com níveis configuráveis e unifica todas as modalidades de entrada — texto, imagem, vídeo e áudio — em $1.50/M tokens, com um nível em lote com 50% de desconto. Oferece visão, uso de ferramentas, cache de prompts, entrada de PDF e busca na web. Janela de contexto: 1M tokens, saída: 64K. Disponível pelos protocolos OpenAI e Gemini.

Janela de Contexto
1M
Tokens Máx de Saída
66K
Lançamento
2026-07-21
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de ÁudioEntrada de VídeoEntrada PDF
Provedores Disponíveis
GoogleCloudVertex
Protocolos Suportados
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Tokens de Entrada
$1.5/M
Tokens de Saída
$7.5/M
Leitura de Cache
$0.15/M
Escrita de Cache
$0.083/M
Entrada de Áudio
$1.5/M
Escrita de Cache (1 hora)
$1/M
Áudio em Cache
$0.15/M
Busca Web
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Exemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.6-flash",
contents="Hello!",
)
print(response.text)

Perguntas Frequentes

Google: Gemini 3.6 Flash na Ofox.ai custa $1.5/M por milhão de tokens de entrada e $7.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.