Gemini

Google: Gemini 3.5 Flash Lite

Chat
google/gemini-3.5-flash-lite
CompararEmpezar

Gemini 3.5 Flash Lite es el modelo multimodal de alto rendimiento y baja latencia de Google con capacidades agénticas mejoradas, publicado el 2026-07-21 como sucesor de Gemini 3.1 Flash Lite. Está orientado a subagentes que ejecutan tareas concretas dentro de flujos de trabajo multiagente complejos, además de búsqueda agéntica y procesamiento de documentos. Todas las modalidades de entrada —texto, imagen, vídeo y audio— se unifican en $0.30/M tokens, con un nivel por lotes con un 50% de descuento. Admite razonamiento, uso de herramientas, almacenamiento en caché de prompts, entrada de PDF y búsqueda web. Ventana de contexto: 1M tokens, salida: 64K. Disponible a través de los protocolos OpenAI y Gemini.

Ventana de Contexto
1M
Tokens de Salida Máximos
66K
Lanzamiento
2026-07-21
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de AudioEntrada de VideoEntrada PDF
Proveedores Disponibles
GoogleCloudVertex
Protocolos Soportados
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
Tokens de Entrada
$0.3/M
Tokens de Salida
$2.5/M
Lectura de Caché
$0.03/M
Escritura de Caché
$0.083/M
Entrada de Audio
$0.3/M
Escritura Caché (1 hora)
$1/M
Audio en Caché
$0.03/M
Búsqueda Web
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Ejemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.run/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.5-flash-lite",
contents="Hello!",
)
print(response.text)

Preguntas Frecuentes

Google: Gemini 3.5 Flash Lite en Ofox.ai cuesta $0.3/M por millón de tokens de entrada y $2.5/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.