Google: Gemini 3.8 Flash

Chat-50%
google/gemini-3.8-flash

O Gemini 3.8 Flash é o modelo Flash mais inteligente do Google, lançado em 2026-09-02, com ganhos significativos sobre o 3.7 Flash em engenharia de software, tarefas de agente e raciocínio de várias etapas. É um modelo de pensamento com níveis configuráveis e aceita todas as modalidades de entrada — texto, imagem, áudio, vídeo e PDF — com preço de entrada unificado. Suporta uso de ferramentas, cache de prompts e busca na web. Janela de contexto: 1M tokens, saída: 64K. Há um nível em lote com 50% de desconto para cargas que toleram latência. Disponível pelos protocolos compatível com OpenAI e Gemini via Ofox.

Janela de Contexto
1M
Tokens Máx de Saída
66K
Lançamento
2026-09-02
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de ÁudioEntrada de VídeoEntrada PDF
Provedores Disponíveis
Vertex
Protocolos Suportados
openaigemini

Providers

Vertex
-50%
Tokens de Entrada
$0.75/M
$1.5/M
Tokens de Saída
$3.75/M
$7.5/M
Leitura de Cache
$0.075/M
$0.15/M
Escrita de Cache
$0.0415/M
$0.083/M
Entrada de Áudio
$0.75/M
$1.5/M
Escrita de Cache (1 hora)
$0.5/M
$1/M
Áudio em Cache
$0.075/M
$0.15/M
Busca Web
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Exemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.8-flash",
contents="Hello!",
)
print(response.text)

Disponibilidade e status

Perguntas Frequentes

Google: Gemini 3.8 Flash na Ofox.ai custa $1.5/M por milhão de tokens de entrada e $7.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.