Gemini

Google: Gemini 3.6 Flash

Chat
google/gemini-3.6-flash
VergleichenLoslegen

Gemini 3.6 Flash ist Googles auf Token-Effizienz ausgelegtes Arbeitspferd, veröffentlicht am 2026-07-21. Es erzeugt 17 % weniger Ausgabetokens als Gemini 3.5 Flash, benötigt in mehrstufigen agentischen Workflows weniger Denkschritte und Werkzeugaufrufe und nimmt präzisere Codeänderungen mit weniger Ausführungsschleifen vor. Als Thinking-Modell mit konfigurierbaren Stufen vereinheitlicht es alle Eingabemodalitäten – Text, Bild, Video und Audio – bei $1.50/M Tokens, die Batch-Stufe bietet 50 % Rabatt. Unterstützt werden Bildverständnis, Werkzeugaufrufe, Prompt-Caching, PDF-Eingabe und Websuche. Kontextfenster: 1M Tokens, Ausgabe: 64K. Verfügbar über die Protokolle OpenAI und Gemini.

Kontextfenster
1M
Max. Ausgabe-Tokens
66K
Veröffentlicht
2026-07-21
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheAudio-EingabeVideo-EingabePDF-Eingabe
Verfügbare Anbieter
GoogleCloudVertex
Unterstützte Protokolle
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Eingabe-Tokens
$1.5/M
Ausgabe-Tokens
$7.5/M
Cache-Lesen
$0.15/M
Cache-Schreiben
$0.083/M
Audioeingabe
$1.5/M
Cache-Schreiben (1 Std.)
$1/M
Gecachtes Audio
$0.15/M
Websuche
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Code-Beispiele

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.6-flash",
contents="Hello!",
)
print(response.text)

Häufig gestellte Fragen

Google: Gemini 3.6 Flash auf Ofox.ai kostet $1.5/M pro Million Eingabe-Tokens und $7.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.