Google: Gemini 3.8 Flash

Chat-50%
google/gemini-3.8-flash

Gemini 3.8 Flash es el modelo Flash más inteligente de Google, lanzado el 2026-09-02, con mejoras significativas sobre 3.7 Flash en ingeniería de software, tareas de agente y razonamiento de varios pasos. Es un modelo de pensamiento con niveles configurables y acepta todas las modalidades de entrada —texto, imagen, audio, vídeo y PDF— con precio de entrada unificado. Admite uso de herramientas, caché de prompts y búsqueda web. Ventana de contexto: 1M tokens, salida: 64K. Existe un nivel por lotes con un 50% de descuento para cargas que toleran latencia. Disponible mediante los protocolos compatible con OpenAI y Gemini a través de Ofox.

Ventana de Contexto
1M
Tokens de Salida Máximos
66K
Lanzamiento
2026-09-02
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de AudioEntrada de VideoEntrada PDF
Proveedores Disponibles
Vertex
Protocolos Soportados
openaigemini

Providers

Vertex
-50%
Tokens de Entrada
$0.75/M
$1.5/M
Tokens de Salida
$3.75/M
$7.5/M
Lectura de Caché
$0.075/M
$0.15/M
Escritura de Caché
$0.0415/M
$0.083/M
Entrada de Audio
$0.75/M
$1.5/M
Escritura Caché (1 hora)
$0.5/M
$1/M
Audio en Caché
$0.075/M
$0.15/M
Búsqueda Web
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Ejemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.8-flash",
contents="Hello!",
)
print(response.text)

Disponibilidad y estado

Preguntas Frecuentes

Google: Gemini 3.8 Flash en Ofox.ai cuesta $1.5/M por millón de tokens de entrada y $7.5/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.