Google: Gemini 3.7 Flash

Chat-50%
google/gemini-3.7-flash

Gemini 3.7 Flash ist Googles multimodales Arbeitspferd für schnelle agentische Workflows, Coding und komplexes mehrstufiges Reasoning, veröffentlicht am 2026-08-13 und verbessert gegenüber Gemini 3.6 Flash bei agentischen Benchmarks wie GPQA Diamond (~94 %) und TAU-Bench (~80 %). Es ist ein Thinking-Modell mit konfigurierbaren Reasoning-Stufen und nimmt alle Eingabemodalitäten entgegen – Text, Bild, Video und Audio. Unterstützt werden Vision, Werkzeugaufrufe, Prompt-Caching, PDF-Eingabe und Websuche. Kontextfenster: 1M Tokens, Ausgabe: 64K. Verfügbar über die Protokolle OpenAI und Gemini.

Kontextfenster
1M
Max. Ausgabe-Tokens
66K
Veröffentlicht
2026-08-13
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheAudio-EingabeVideo-EingabePDF-Eingabe
Verfügbare Anbieter
Vertex
Unterstützte Protokolle
openaigemini

Providers

Vertex
-50%
Eingabe-Tokens
$0.75/M
$1.5/M
Ausgabe-Tokens
$3.75/M
$7.5/M
Cache-Lesen
$0.075/M
$0.15/M
Cache-Schreiben
$0.0415/M
$0.083/M
Audioeingabe
$0.75/M
$1.5/M
Cache-Schreiben (1 Std.)
$0.5/M
$1/M
Gecachtes Audio
$0.075/M
$0.15/M
Websuche
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Code-Beispiele

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.7-flash",
contents="Hello!",
)
print(response.text)

Verfügbarkeit & Status

Häufig gestellte Fragen

Google: Gemini 3.7 Flash auf Ofox.ai kostet $1.5/M pro Million Eingabe-Tokens und $7.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.