Google: Gemini 3.8 Flash

Chat-50%
google/gemini-3.8-flash

Gemini 3.8 Flash ist Googles intelligentestes Flash-Modell, veröffentlicht am 2026-09-02, mit deutlichen Zugewinnen gegenüber 3.7 Flash bei Software-Engineering, agentischen Aufgaben und mehrstufigem Reasoning. Es ist ein Thinking-Modell mit konfigurierbaren Thinking-Stufen und nimmt sämtliche Eingabemodalitäten entgegen — Text, Bild, Audio, Video und PDF — zu einheitlichem Eingabepreis. Unterstützt Werkzeugaufrufe, Prompt Caching und Websuche. Kontextfenster: 1M Tokens, Output: 64K. Für latenztolerante Workloads steht eine Batch-Stufe mit 50% Rabatt bereit. Verfügbar über OpenAI-kompatibles und Gemini-Protocol über Ofox.

Kontextfenster
1M
Max. Ausgabe-Tokens
66K
Veröffentlicht
2026-09-02
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheAudio-EingabeVideo-EingabePDF-Eingabe
Verfügbare Anbieter
Vertex
Unterstützte Protokolle
openaigemini

Providers

Vertex
-50%
Eingabe-Tokens
$0.75/M
$1.5/M
Ausgabe-Tokens
$3.75/M
$7.5/M
Cache-Lesen
$0.075/M
$0.15/M
Cache-Schreiben
$0.0415/M
$0.083/M
Audioeingabe
$0.75/M
$1.5/M
Cache-Schreiben (1 Std.)
$0.5/M
$1/M
Gecachtes Audio
$0.075/M
$0.15/M
Websuche
$0.014/R
Protocols
openai/v1/chat/completions
gemini

Code-Beispiele

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.8-flash",
contents="Hello!",
)
print(response.text)

Verfügbarkeit & Status

Häufig gestellte Fragen

Google: Gemini 3.8 Flash auf Ofox.ai kostet $1.5/M pro Million Eingabe-Tokens und $7.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.