Google: Gemini 3.7 Flash

Chat-50%
google/gemini-3.7-flash

Gemini 3.7 Flash es el modelo multimodal de trabajo de Google para flujos de trabajo agénticos rápidos, programación y razonamiento complejo de varios pasos, lanzado el 2026-08-13 y con mejoras respecto a Gemini 3.6 Flash en pruebas agénticas como GPQA Diamond (~94%) y TAU-Bench (~80%). Es un modelo de razonamiento con niveles configurables que acepta todas las modalidades de entrada: texto, imagen, vídeo y audio. Admite visión, uso de herramientas, almacenamiento en caché de prompts, entrada de PDF y búsqueda web. Ventana de contexto: 1M tokens, salida: 64K. Disponible a través de los protocolos OpenAI y Gemini.

Ventana de Contexto
1M
Tokens de Salida Máximos
66K
Lanzamiento
2026-08-13
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de AudioEntrada de VideoEntrada PDF
Proveedores Disponibles
Vertex
Protocolos Soportados
openaigemini

Providers

Vertex
-50%
Tokens de Entrada
$0.75/M
$1.5/M
Tokens de Salida
$3.75/M
$7.5/M
Lectura de Caché
$0.075/M
$0.15/M
Escritura de Caché
$0.0415/M
$0.083/M
Entrada de Audio
$0.75/M
$1.5/M
Escritura Caché (1 hora)
$0.5/M
$1/M
Audio en Caché
$0.075/M
$0.15/M
Búsqueda Web
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Ejemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.7-flash",
contents="Hello!",
)
print(response.text)

Disponibilidad y estado

Preguntas Frecuentes

Google: Gemini 3.7 Flash en Ofox.ai cuesta $1.5/M por millón de tokens de entrada y $7.5/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.