Z.ai: GLM-5.3-FlashX
Chatz-ai/glm-5.3-flashxGLM-5.3-FlashX — это лёгкая высокоскоростная модель z.ai на международном сайте (api.z.ai), созданная для эффективного программирования и длительных Agent-задач: скорость вывода достигает 200 tokens/s, обеспечивая более быструю и плавную работу с моделью. Поддерживает нативный мультимодальный ввод (изображения, видео), контекст 1M, постоянный thinking (не отключается, доступны три уровня reasoning effort: low, high, max), prompt caching, tool calling и web search, а также подключается по двум протоколам — OpenAI-compatible и Anthropic (конечная точка Responses не поддерживается).
Контекстное окно
1M
Макс. выходных токенов
131K
Дата релиза
2026-08-26
Возможности
ЗрениеFunction CallingРассуждениеКэширование промптовВеб-поискВидео-вход
Доступные провайдеры
Z.ai
Поддерживаемые протоколы
openaianthropic
Providers
Z.ai
provider.type: "zai"Входные токены
$0.15/M
Выходные токены
$0.5/M
Чтение кэша
$0.03/M
Веб-поиск
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Примеры кода
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5.3-flashx",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Похожие модели
Часто задаваемые вопросы
Z.ai: GLM-5.3-FlashX на Ofox.ai стоит $0.15/M за миллион входных токенов и $0.5/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.
Z.ai: GLM-5.3-FlashX поддерживает контекстное окно 1M токенов с максимальным выходом 131K токенов, позволяя обрабатывать большие документы и вести длинные диалоги.
Просто установите base URL на https://api.ofox.run/v1 и используйте API-ключ Ofox. API совместим с OpenAI — просто измените base URL и API-ключ в существующем коде.
Z.ai: GLM-5.3-FlashX поддерживает следующие возможности: Зрение, Function Calling, Рассуждение, Кэширование промптов, Веб-поиск, Видео-вход. Все функции доступны через единый API Ofox.ai.