Gemini 3.6 Flash es el modelo de trabajo de Google centrado en la eficiencia de tokens, publicado el 2026-07-21. Genera un 17% menos de tokens de salida que Gemini 3.5 Flash, necesita menos pasos de razonamiento y llamadas a herramientas en flujos de trabajo agénticos de varios pasos y realiza ediciones de código más precisas con menos bucles de ejecución. Es un modelo de razonamiento con niveles configurables y unifica todas las modalidades de entrada —texto, imagen, vídeo y audio— en $1.50/M tokens, con un nivel por lotes con un 50% de descuento. Admite visión, uso de herramientas, almacenamiento en caché de prompts, entrada de PDF y búsqueda web. Ventana de contexto: 1M tokens, salida: 64K. Disponible a través de los protocolos OpenAI y Gemini.
Providers
/v1/chat/completionsEjemplos de Código
from google import genaiclient = genai.Client(api_key="YOUR_OFOX_API_KEY",http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},)response = client.models.generate_content(model="google/gemini-3.6-flash",contents="Hello!",)print(response.text)