GPT-4.1 是 OpenAI 于 2025年4月14日发布的上一代旗舰模型,针对高级指令遵循、真实软件工程与长上下文推理优化。1M tokens 的上下文窗口适合复杂文档分析与大规模代码生成,模型支持图像输入、工具调用、提示缓存与音频输入。上下文窗口 1M tokens,输出 32K。前沿编码任务已由更新的 GPT-5 系列与 Codex 系列接手,但 GPT-4.1 在长文档处理与既有集成中仍是稳妥且成本更低的选择。可通过 OpenAI 兼容协议接入。
上下文窗口
1M
最大输出 Token
33K
发布日期
2025-04-14
能力
视觉函数调用提示缓存音频输入
可用供应商
Azure
支持的协议
openai
供应商
Azure
输入 Token
$2/M
输出 Token
$8/M
缓存读取
$0.5/M
网络搜索
$0.035/R
接入协议
openai
/v1/chat/completions/v1/responses代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="openai/gpt-4.1",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
第三方评测
LMArena ↗评测条目:gpt-4.1-2025-04-14
GPT-4.1 在 LMArena 文本榜单(风格控制) 综合类别中获得 1414 分,在 374 个模型中排名第 109,基于 50,934 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1414 | 1410–1417 | 第 109 / 374 名 | 50,934 |
| 困难任务 | 1431 | 1426–1436 | 第 111 / 374 名 | 22,148 |
| 编程 | 1456 | 1450–1463 | 第 113 / 369 名 | 9,308 |
| 数学 | 1373 | 1363–1383 | 第 157 / 362 名 | 3,222 |
| 创意写作 | 1402 | 1395–1410 | 第 78 / 372 名 | 6,702 |
| 指令遵循 | 1403 | 1397–1408 | 第 107 / 374 名 | 13,281 |
| 中文 | 1416 | 1403–1428 | 第 133 / 344 名 | 2,462 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
GPT-4.1 在 Ofox.ai 上的价格为输入 $2/M/百万 Token,输出 $8/M/百万 Token。按量计费,无月费。
GPT-4.1 支持 1M Token 的上下文窗口,最大输出 33K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.run/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
GPT-4.1 支持以下能力:视觉, 函数调用, 提示缓存, 音频输入。通过 Ofox.ai 统一 API 访问所有功能。