Gemini

Google: Gemini 3.6 Flash

Chat
google/gemini-3.6-flash
CompararEmpezar

Gemini 3.6 Flash es el modelo de trabajo de Google centrado en la eficiencia de tokens, publicado el 2026-07-21. Genera un 17% menos de tokens de salida que Gemini 3.5 Flash, necesita menos pasos de razonamiento y llamadas a herramientas en flujos de trabajo agénticos de varios pasos y realiza ediciones de código más precisas con menos bucles de ejecución. Es un modelo de razonamiento con niveles configurables y unifica todas las modalidades de entrada —texto, imagen, vídeo y audio— en $1.50/M tokens, con un nivel por lotes con un 50% de descuento. Admite visión, uso de herramientas, almacenamiento en caché de prompts, entrada de PDF y búsqueda web. Ventana de contexto: 1M tokens, salida: 64K. Disponible a través de los protocolos OpenAI y Gemini.

Ventana de Contexto
1M
Tokens de Salida Máximos
66K
Lanzamiento
2026-07-21
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de AudioEntrada de VideoEntrada PDF
Proveedores Disponibles
GoogleCloudVertex
Protocolos Soportados
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Tokens de Entrada
$1.5/M
Tokens de Salida
$7.5/M
Lectura de Caché
$0.15/M
Escritura de Caché
$0.083/M
Entrada de Audio
$1.5/M
Escritura Caché (1 hora)
$1/M
Audio en Caché
$0.15/M
Búsqueda Web
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Ejemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.6-flash",
contents="Hello!",
)
print(response.text)

Preguntas Frecuentes

Google: Gemini 3.6 Flash en Ofox.ai cuesta $1.5/M por millón de tokens de entrada y $7.5/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.