按量付费 API 和订阅,聊 AI 哪个更便宜?
按量付费的 API,还是每月 20 美元的 AI 订阅?一份可以自己复算的对比,价格取自官方,截至 2026 年 9 月 28 日,也教你怎么代入自己的用量。
- 轻度到中度聊天,按量付费的 API 通常比每月 20 美元的订阅(比如 ChatGPT Plus、Claude Pro)便宜;如果每天大量使用顶级模型,订阅反而可能更划算。截至 2026 年 9 月 28 日,用 Claude Sonnet 5 或 GPT-6 Sol 这类中档模型,走 API 发一条常规消息,预估约 1 美分,所以 20 美元大约够发 2,000 条。
- 临界点会随模型和对话长度大幅变化:用 Claude Opus 5.5 大约是每月 1,000 条,用 Gemini 3.8 Flash 则超过 5,000 条(均为预估)。
- 订阅里还包含 API 没有的应用功能,也有它自己的用量上限,所以价格只是决定的一部分。

两种付钱的方式
订阅,是给供应商自己的聊天应用每月交一笔固定费用。在订阅的用量上限之内,你发十条还是一万条,交的钱都一样,同时能用上那个应用自带的各种功能。按量付费的 API 账户,则是按 token 计费:每条消息都有一小笔费用,多少取决于用哪个模型,以及发出和收到的文字有多长。
不写代码也能用 API:把你自己的 API Key 粘贴进一个聊天应用就行,也就是“自带 Key”(BYOK)的用法。本文比的就是这两种:同样是日常聊天,一种走订阅,一种用你自己的 API Key。
订阅价格,截至 2026 年 9 月 28 日
下表列的是大多数人会拿来比较的个人订阅方案,美国区价格,取自各家供应商的官方定价页或帮助中心,核对日期是 2026 年 9 月 28 日。不同国家和地区的价格、税费可能不一样,方案也常有调整,参考前请先看一眼来源页面。
| 订阅方案 | 美国区月费 | 来源 |
|---|---|---|
| ChatGPT Plus | $20 | OpenAI 帮助中心《What is ChatGPT Plus?》 |
| Claude Pro | 按月付 $20,或按年付折合每月 $17(每年 $200) | claude.com/pricing |
| Claude Max | $100 起 | claude.com/pricing |
| Google AI Plus | $4.99 | gemini.google/subscriptions |
| Google AI Pro | $19.99 | gemini.google/subscriptions |
| Google AI Ultra | $99.99 起 | gemini.google/subscriptions |
一条 API 消息的费用怎么估
API 按每百万 token 标价,输入(你发出去的)和输出(模型写回来的)分开定价。1 个 token 大约相当于四分之三个英文单词。一条消息的预估费用是:输入 token 数 × 输入单价 + 输出 token 数 × 输出单价。
下面的例子里,“常规消息”指 2,000 个输入 token 加 600 个输出 token。输入比一句提问长,是因为聊天应用每一轮都会把前面的对话重新发一遍;2,000 token 大约是一个问题外加前面几轮来回。输出 600 token 大约是一段 450 字左右的回答(按英文词数算)。你自己的平均值肯定不一样,文末的计算器可以填你自己的数字。
按这个假设,再套用各家供应商截至 2026 年 9 月 28 日公布的标准价格,下表给出每条消息的预估费用,以及三档用量下的每月预估费用:轻度(每天 10 条,每月 300 条)、中度(每天 40 条,每月 1,200 条)、重度(每天 100 条,每月 3,000 条)。
| 模型(输入 / 输出,美元每百万 token) | 每条消息 | 轻度:每月 300 条 | 中度:每月 1,200 条 | 重度:每月 3,000 条 |
|---|---|---|---|---|
| GPT-6 Luna (0.10 / 0.50) | $0.0005 | $0.15 | $0.60 | $1.50 |
| Gemini 3.8 Flash (0.75 / 3.75) | $0.00375 | $1.13 | $4.50 | $11.25 |
| Claude Haiku 4.5 (1 / 5) | $0.005 | $1.50 | $6.00 | $15.00 |
| Claude Sonnet 5 (2 / 10) | $0.010 | $3.00 | $12.00 | $30.00 |
| GPT-6 Sol (2 / 10) | $0.010 | $3.00 | $12.00 | $30.00 |
| Gemini 3.1 Pro Preview (2 / 12) | $0.0112 | $3.36 | $13.44 | $33.60 |
| Claude Opus 5.5 (4 / 20) | $0.020 | $6.00 | $24.00 | $60.00 |
临界点在哪
用每月 20 美元的订阅费除以每条消息的预估费用,就得到 API 和订阅花费持平时的消息条数。低于这个数,API 更便宜;高于这个数,订阅更划算。截至 2026 年 9 月 28 日,按上面定义的常规消息算:
规律很明显。用便宜的模型,临界点远高于大多数人的实际用量,按量付费轻松胜出。用中档模型,临界点大约是每天 60 到 70 条、天天如此,这比不少人发得多,但对一整天都在用 AI 干活的人来说也不算夸张。用最强的那档模型,临界点降到每天 33 条左右。
| 模型 | 20 美元对应的每月消息数(预估) | 折合每天(预估) |
|---|---|---|
| GPT-6 Luna | 约 40,000 | 约 1,333 |
| Gemini 3.8 Flash | 约 5,333 | 约 178 |
| Claude Haiku 4.5 | 约 4,000 | 约 133 |
| Claude Sonnet 5 或 GPT-6 Sol | 约 2,000 | 约 67 |
| Gemini 3.1 Pro Preview | 约 1,786 | 约 60 |
| Claude Opus 5.5 | 约 1,000 | 约 33 |
哪些因素会改变结论
影响最大的是对话长度。因为每一轮都要把之前的内容重发一遍,对话越长,每条消息的输入部分就越大。如果你的平均输入是 8,000 token 而不是 2,000,一条 Claude Sonnet 5 消息的预估费用就是 8,000 × $2 / 1,000,000 + 600 × $10 / 1,000,000 = $0.022,临界点从每月约 2,000 条降到约 909 条(截至 2026 年 9 月 28 日)。
其他因素,有的让费用变高,有的让费用变低:
- 推理模型的思考过程也按输出 token 计费,难题的费用可能是常规消息的好几倍。
- 附件会带来额外的输入 token,只要它还留在对话里,每一轮都会算。
- 如果供应商支持提示缓存,重复的上下文按更低的价格计费,API 费用会往下走。
- 模型搭配很重要:大部分消息用便宜的模型,只在需要时才上强模型,往往比所有消息都用最强的模型便宜得多。
- 供应商的价格会变,有时是提前公布好日期的;比如 Google 已经公布,从 2027 年 1 月 1 日起 Gemini 3.8 Flash 的价格会更高。
订阅里有、API 里没有的东西
每条消息的价格,不是比较的全部。订阅买到的是供应商完整的个人版应用,里面可能有语音对话、图片或视频生成、深度研究模式、文件和项目工作区,以及各种集成,这些光靠一把 API Key 是拿不到的。如果你就是冲着这些功能,API 并不能一对一替代。
订阅也有上限。各家订阅对额度的说法多是相对的,比如 Claude Max 被描述为用量是 Pro 的 5 倍或 20 倍,重度用户还是可能碰到上限。API 也有限制,但那是速率限制,往上升一个用量档位就能提高,不是每月的固定额度。
反过来,API 的好处是可以跨供应商自由选模型、用多少付多少,还能看到每条消息花了多少。很多人最后是两种混着用:一份订阅给自己整天泡着的那个应用,其余的都用 API Key。
五分钟做个决定
你不需要一个放之四海皆准的答案,只需要适合自己的那个。花几分钟老老实实估一下就够了。
- 数一数平常一周发多少条消息,别拿最忙的那一周算。
- 想好大部分消息会用哪个模型。
- 乘以上表里每条消息的预估费用,或者把数字填进计算器。
- 把得出的月总额和你在考虑的订阅比一比,再想想哪些订阅功能你会舍不得。
- 如果和临界点很接近,可以先用 API 试一个月,设好消费上限,再对照供应商的账单。
边聊边看到花了多少
按量付费最大的好处,是费用看得见。Oriveo 是一款 iPhone、Android 和网页版都有的聊天应用,可以接入你在 15 家官方供应商的 API Key,并在每条消息上显示预估费用,依据是供应商的标价和回答里返回的 token 数。用你自己的 Key 时,账单由各家供应商直接开给你,Oriveo 不加价。
预估费用是帮你在月中把握花销的。供应商开出的账单才是最终数字,两者不一致时,以账单为准。