2026 年最便宜的 LLM API
當預算是硬性限制時,目標就是「夠用前提下最便宜」。這份排名把 Ofox 上最實惠的模型——包括免費額度——依實際每 token 成本排序,讓你在不犧牲必要效能的前提下,把帳單壓下來。
推薦模型
1
Qwen Turbo首選推薦
qwen/qwen-turbo · dashscope77符合度
成本最低回應迅速
128K
上下文
$0.043/M
輸入
$0.09/M
輸出
查看詳情
2
Doubao Seed 1.6 Flash
volcengine/doubao-seed-1-6-flash · Volcengine73符合度
非常實惠回應迅速
256K
上下文
$0.03/M
輸入
$0.22/M
輸出
查看詳情
3
Z.ai: GLM-4.7 FlashX
z-ai/glm-4.7-flashx · Zhipu70符合度
CP 值均衡
200K
上下文
$0.072/M
輸入
$0.4/M
輸出
查看詳情
4
GPT-5 Nano
openai/gpt-5-nano · OpenAI70符合度
回應迅速
128K
上下文
$0.05/M
輸入
$0.4/M
輸出
查看詳情
5
Google: Gemini 2.5 Flash Lite
google/gemini-2.5-flash-lite · google68符合度
超長上下文回應迅速
1M
上下文
$0.1/M
輸入
$0.4/M
輸出
查看詳情
6
DeepSeek V4 Flash 0423
deepseek/deepseek-v4-flash-0423 · DeepSeek68符合度
超長上下文回應迅速
1M
上下文
$0.19/M
輸入
$0.51/M
輸出
查看詳情
想要更精準的結果?
開啟互動式推薦器並預先帶入這個情境,再調整優先項目和必備能力,進一步微調候選清單。
在推薦器中微調我們如何排名
推薦結合模型目錄、已有評測參考與估算規則,綜合品質、成本、速度及任務適配。速度是估計值,並非延遲實測;請以自己的任務驗證候選模型。
相關問題
常見問題
推薦器是怎麼挑模型的?+
它會從品質、成本、速度,以及與你使用情境的契合度這四個維度,為 Ofox 上每個未下架的模型評分,再依你選的優先項目加權。品質參考模型等級與能力,成本以實際的每 token 價格為依據,契合度則看模型有沒有針對你的任務(程式開發、視覺、長上下文等)做過最佳化。
它免費嗎?需要帳號嗎?+
完全免費,而且在瀏覽器裡執行——取得推薦免登入、免 API Key。只有當你真的要呼叫模型時,才需要 Ofox 帳號。
這些是真實且最新的模型嗎?+
每一筆推薦都來自 Ofox 即時模型目錄(100+ 個模型,持續更新)。顯示的價格與上下文長度都直接取自該目錄。
為什麼最便宜的模型不一定排第一?+
除非你選擇「最低成本」,否則推薦器會在價格與品質、能力之間權衡。一個貴一點但強很多的模型往往得分更高——就像人會做的選擇一樣。
推薦的模型能用在我現有的程式碼裡嗎?+
可以。每個模型都透過統一的 OpenAI / Anthropic / Gemini 相容端點提供。只要改 base URL 和 API Key,現有的 SDK 程式碼不必改動即可執行。