Gemini 3.6 Flash est le modèle de travail de Google axé sur l'efficacité en tokens, publié le 2026-07-21. Il produit 17 % de tokens de sortie en moins que Gemini 3.5 Flash, requiert moins d'étapes de raisonnement et d'appels d'outils dans les workflows agentiques à plusieurs étapes, et effectue des modifications de code plus précises avec moins de boucles d'exécution. Modèle de réflexion à niveaux configurables, il unifie toutes les modalités d'entrée — texte, image, vidéo et audio — à $1.50/M tokens, avec un palier par lots bénéficiant d'une remise de 50 %. La vision, l'appel d'outils, la mise en cache des prompts, l'entrée PDF et la recherche web sont pris en charge. Fenêtre de contexte : 1M tokens, sortie : 64K. Disponible via les protocoles OpenAI et Gemini.
Providers
/v1/chat/completionsExemples de code
from google import genaiclient = genai.Client(api_key="YOUR_OFOX_API_KEY",http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},)response = client.models.generate_content(model="google/gemini-3.6-flash",contents="Hello!",)print(response.text)