GLM-4.6 是 Z.ai 于 2025 年 9 月 30 日发布的 GLM 系列对话模型,指令遵循能力强,在性能与成本之间取得了出色的平衡,尤其擅长中文任务。它支持推理、函数调用(工具调用)、提示缓存和联网搜索。上下文窗口 200K tokens,输出 128K。输入价格为 $0.40/M tokens,输出为 $1.90/M,缓存输入读取为 $0.11/M。可通过 OpenAI 与 Anthropic 两种协议调用。
上下文窗口
200K
最大输出 Token
128K
发布日期
2025-09-30
能力
函数调用推理提示缓存网络搜索
可用供应商
Zhipu
支持的协议
openaianthropic
供应商
Zhipu
输入 Token
$0.4/M
输出 Token
$1.9/M
缓存读取
$0.11/M
网络搜索
$0.01/R
接入协议
openai
/v1/chat/completionsanthropic
代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.6",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
第三方评测
LMArena ↗评测条目:glm-4.6
Z.ai: GLM-4.6 在 LMArena 文本榜单(风格控制) 综合类别中获得 1425 分,在 374 个模型中排名第 86,基于 35,623 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1425 | 1421–1429 | 第 86 / 374 名 | 35,623 |
| 困难任务 | 1442 | 1437–1447 | 第 93 / 374 名 | 19,079 |
| 编程 | 1459 | 1452–1466 | 第 107 / 369 名 | 7,478 |
| 数学 | 1421 | 1408–1433 | 第 91 / 362 名 | 2,107 |
| 创意写作 | 1402 | 1394–1411 | 第 77 / 372 名 | 5,087 |
| 指令遵循 | 1415 | 1409–1422 | 第 89 / 374 名 | 10,002 |
| 中文 | 1482 | 1468–1497 | 第 62 / 344 名 | 1,649 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
Z.ai: GLM-4.6 在 Ofox.ai 上的价格为输入 $0.4/M/百万 Token,输出 $1.9/M/百万 Token。按量计费,无月费。
Z.ai: GLM-4.6 支持 200K Token 的上下文窗口,最大输出 128K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.run/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
Z.ai: GLM-4.6 支持以下能力:函数调用, 推理, 提示缓存, 网络搜索。通过 Ofox.ai 统一 API 访问所有功能。