20% en todo GPT 🎉 30% en DeepSeekMás info

Gemini 2.5 Pro TTS

Voz
google/gemini-2.5-pro-tts
Proveedores Disponibles
Vertex
Protocolos Soportados
openai

Providers

Vertex
Tokens de Entrada
$1/M
Tokens de Salida
$20/M
Audio de Salida
$20/M
Protocols
openai/v1/audio/speech

Ejemplos de Código

from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.run/v1", api_key="YOUR_OFOX_API_KEY")
response = client.audio.speech.create(
model="google/gemini-2.5-pro-tts",
voice="Kore",
input="Hello from OFOX.",
response_format="wav",
speed=1.1,
extra_body={"language_code": "en-US", "instructions": "Speak warmly and clearly."},
)
response.stream_to_file("speech.wav")

Modelos Gemini TTS anteriores: language_code e instructions son opcionales; speed indica un ritmo aproximado. Solo se puede elegir WAV. En SSE, WAV explícito devuelve un archivo completo; sin response_format se mantienen los bloques PCM.

Preguntas Frecuentes

Simplemente configura tu base URL a https://api.ofox.run/v1 y usa tu API key de Ofox. La API es compatible con OpenAI — solo cambia la base URL y la API key en tu código existente.