Gemini

Google: Gemini 3.5 Flash Lite

Chat
google/gemini-3.5-flash-lite
VergleichenLoslegen

Gemini 3.5 Flash Lite ist Googles multimodales Modell mit hohem Durchsatz und niedriger Latenz sowie erweiterten agentischen Fähigkeiten, veröffentlicht am 2026-07-21 als Nachfolger von Gemini 3.1 Flash Lite. Es richtet sich an Subagenten, die eng umrissene Aufgaben innerhalb komplexer Multi-Agenten-Workflows erledigen, sowie an agentische Suche und Dokumentenverarbeitung. Alle Eingabemodalitäten – Text, Bild, Video und Audio – sind einheitlich mit $0.30/M Tokens bepreist, die Batch-Stufe bietet 50 % Rabatt. Unterstützt werden Reasoning, Werkzeugaufrufe, Prompt-Caching, PDF-Eingabe und Websuche. Kontextfenster: 1M Tokens, Ausgabe: 64K. Verfügbar über die Protokolle OpenAI und Gemini.

Kontextfenster
1M
Max. Ausgabe-Tokens
66K
Veröffentlicht
2026-07-21
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheAudio-EingabeVideo-EingabePDF-Eingabe
Verfügbare Anbieter
GoogleCloudVertex
Unterstützte Protokolle
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Eingabe-Tokens
$0.3/M
Ausgabe-Tokens
$2.5/M
Cache-Lesen
$0.03/M
Cache-Schreiben
$0.083/M
Audioeingabe
$0.3/M
Cache-Schreiben (1 Std.)
$1/M
Gecachtes Audio
$0.03/M
Websuche
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Code-Beispiele

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.5-flash-lite",
contents="Hello!",
)
print(response.text)

Häufig gestellte Fragen

Google: Gemini 3.5 Flash Lite auf Ofox.ai kostet $0.3/M pro Million Eingabe-Tokens und $2.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.