Gemini 2.5 Flash TTS
Sprachausgabegoogle/gemini-2.5-flash-ttsVerfügbare Anbieter
Vertex
Unterstützte Protokolle
openai
Providers
Vertex
Eingabe-Tokens
$0.5/M
Ausgabe-Tokens
$10/M
Ausgabe Audio
$10/M
Protocols
openai
/v1/audio/speechCode-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1", api_key="YOUR_OFOX_API_KEY")response = client.audio.speech.create(model="google/gemini-2.5-flash-tts",voice="Kore",input="Hello from OFOX.",response_format="wav",speed=1.1,extra_body={"language_code": "en-US", "instructions": "Speak warmly and clearly."},)response.stream_to_file("speech.wav")
Ältere Gemini-TTS-Modelle: language_code und instructions sind optional; speed steuert das ungefähre Sprechtempo. Nur WAV ist wählbar. Bei SSE liefert explizites WAV eine vollständige Datei; ohne response_format bleiben es PCM-Blöcke.
Verwandte Modelle
Häufig gestellte Fragen
Einfach Ihre Base-URL auf https://api.ofox.run/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.