API 還是訂閱?AI 聊天哪種花得少
按量計費的 API,還是每月 $20 的 AI 訂閱?用截至 2026 年 9 月 28 日的官方價格做一份可重算的比較,並教你跑自己的數字。
- 輕度和中度的聊天用量,按量計費的 API 通常比每月 $20 的訂閱(如 ChatGPT Plus 或 Claude Pro)便宜;重度天天用頂級模型時,訂閱可能反而便宜。截至 2026 年 9 月 28 日,中階模型如 Claude Sonnet 5 或 GPT-6 Sol 上,一則典型訊息經 API 預估約一分錢,所以 $20 大約涵蓋每月 2,000 則這樣的訊息。
- 損益兩平點隨模型選擇和對話長度移動很大:Claude Opus 5.5 大約每月 1,000 則,Gemini 3.8 Flash 則超過 5,000 則,皆為預估。
- 訂閱還包含 API 沒有的 App 功能,也有自己的用量限制,所以價格只是決策的一部分。

兩種付費方式
訂閱是給供應商自家聊天 App 的一筆固定月費。送十則還是一萬則都付一樣——到方案用量上限為止——並拿到內建在那個 App 裡的功能。按量計費的 API 帳戶按 token 收費:每一則都有一個小小的成本,取決於模型,以及送進去、寫出來多少字。
不寫程式也能用 API:把自己的 API 金鑰貼進聊天 App ——也就是「自備金鑰」的模式。這篇做的就是這個比較:同樣的日常聊天,一種用訂閱付,一種用你自己的 API 金鑰付。
訂閱價格(截至 2026 年 9 月 28 日)
下表列出多數人會拿來比的個人方案,美元價格取自各家官方定價或說明頁,時間是 2026 年 9 月 28 日。價格會因國家和當地稅費而不同,供應商也常常改方案;要依賴之前先查連結的頁面。
| 方案 | 美國每月價格 | 來源 |
|---|---|---|
| ChatGPT Plus | $20 | OpenAI 說明中心「What is ChatGPT Plus?」 |
| Claude Pro | 月付 $20,或年付折合每月 $17(一年 $200) | claude.com/pricing |
| Claude Max | 自 $100 起 | claude.com/pricing |
| Google AI Plus | $4.99 | gemini.google/subscriptions |
| Google AI Pro | $19.99 | gemini.google/subscriptions |
| Google AI Ultra | 自 $99.99 起 | gemini.google/subscriptions |
一則 API 訊息的成本怎麼估
API 價格按每百萬 token 報,輸入(你送出的)和輸出(模型寫的)各有單價。一個 token 大約是四分之三個英文單字。一則訊息的預估費用是:輸入 token × 輸入單價 + 輸出 token × 輸出單價。
下面的例子裡,「典型訊息」是 2,000 輸入 token 加 600 輸出 token。輸入比單獨一個問題大,因為聊天 App 每一輪都重送前面的對話;2,000 token 大約是一個問題加上幾輪先前的往來。輸出則是大約 450 個字的答案。你自己的平均值會不同,文末連結的計算機可以填你自己的數字。
用這個假設和各家截至 2026 年 9 月 28 日公示的標準單價,下面是三個用量級的每則與每月預估費用:輕度(每天 10 則,每月 300 則)、中度(每天 40 則,每月 1,200 則)、重度(每天 100 則,每月 3,000 則)。
| 模型(輸入 / 輸出,USD 每 1M tokens) | 每則 | 輕度:每月 300 則 | 中度:每月 1,200 則 | 重度:每月 3,000 則 |
|---|---|---|---|---|
| GPT-6 Luna(0.10 / 0.50) | $0.0005 | $0.15 | $0.60 | $1.50 |
| Gemini 3.8 Flash(0.75 / 3.75) | $0.00375 | $1.13 | $4.50 | $11.25 |
| Claude Haiku 4.5(1 / 5) | $0.005 | $1.50 | $6.00 | $15.00 |
| Claude Sonnet 5(2 / 10) | $0.010 | $3.00 | $12.00 | $30.00 |
| GPT-6 Sol(2 / 10) | $0.010 | $3.00 | $12.00 | $30.00 |
| Gemini 3.1 Pro Preview(2 / 12) | $0.0112 | $3.36 | $13.44 | $33.60 |
| Claude Opus 5.5(4 / 20) | $0.020 | $6.00 | $24.00 | $60.00 |
損益兩平點在哪裡
把 $20 月費除以每則訊息的預估費用,就得到 API 和訂閱打平的訊息則數。低於那個數字,API 便宜;高於它,訂閱便宜。截至 2026 年 9 月 28 日,用上面定義的典型訊息:
模式很清楚。便宜的模型,兩平點遠超過多數人會送出的量,按量計費輕鬆勝出。中階模型的兩平點落在每天 60 到 70 則、天天如此——比很多人多,但對工作整天離不開 AI 的人不算罕見。最強的模型則降到每天 33 則左右。
| 模型 | 每月 $20 能買的訊息數(預估) | 每天訊息數(預估) |
|---|---|---|
| GPT-6 Luna | 約 40,000 | 約 1,333 |
| Gemini 3.8 Flash | 約 5,333 | 約 178 |
| Claude Haiku 4.5 | 約 4,000 | 約 133 |
| Claude Sonnet 5 或 GPT-6 Sol | 約 2,000 | 約 67 |
| Gemini 3.1 Pro Preview | 約 1,786 | 約 60 |
| Claude Opus 5.5 | 約 1,000 | 約 33 |
什麼會改變答案
最大的變數是對話長度。每一輪都重送目前的對話,所以長對話會抬高每一則的輸入側。如果你的平均輸入是 8,000 token 而不是 2,000,一則 Claude Sonnet 5 訊息預估是 8,000 × $2 / 1,000,000 + 600 × $10 / 1,000,000 = $0.022,截至 2026 年 9 月 28 日,兩平點也從約 2,000 則降到約 909 則。
其他變數往兩個方向拉:
- reasoning 模型把思考用的 token 按輸出計費,難題可能花掉典型數字的好幾倍。
- 附件只要留在對話裡,就一直在加輸入 token。
- 供應商支援時,prompt caching 對重複的上下文按較低單價計費,把 API 成本往下拉。
- 模型組合有影響:大部分訊息用便宜的模型、必要時才用強的,往往比什麼都用最強的便宜得多。
- 供應商會改價,有時公布生效日期;例如 Google 公示 Gemini 3.8 Flash 從 2027 年 1 月 1 日起調高價格。
訂閱包含而 API 沒有的東西
每則單價不是整個比較。訂閱買到的是供應商完整的消費端 App,可能包含語音對話、圖片或影片生成、深度研究模式、檔案和專案工作區,以及一把單純的 API 金鑰給不了的整合。你靠這些吃飯的話,API 就不是對等的替代品。
訂閱也有上限。方案用相對的說法描述額度——例如 Claude Max 被描述成提供比 Pro 多 5 倍或 20 倍的用量——重度使用者會頂到。API 也有限制,但那是升用量級別就能調高的速率限制,不是每月額度。
反過來,API 給你跨供應商的模型選擇、用多少付多少,以及逐則費用的可見度。很多人最後是混合使用:常駐的 App 用一份訂閱,其他一切用 API 金鑰。
五分鐘做出決定
你需要的不是一個通用答案,是你自己的答案。一個簡短、誠實的估算就夠做決定。
- 數一個典型星期的訊息量,不是最忙的那個星期。
- 決定大部分訊息你會用哪個模型。
- 乘上上表每則的預估費用,或把你的數字填進計算機。
- 把每月總額和考慮中的訂閱比一比,並記下你會想念的訂閱功能。
- 接近兩平點的話,設一個消費上限,用 API 試一個月,再看實際帳單。
邊用邊看見費用
按量計費最有用的一點是你看得到它。Oriveo 是給 iPhone、Android 和網頁的聊天 App,接上你自己 15 家官方供應商的金鑰,每一則訊息都顯示預估費用,按供應商公示價格和答案回報的 token 算出。用你自己的金鑰,每家供應商直接向你收費,Oriveo 不加價。
估算的用途是在這個月裡調整你的花費。供應商的帳單才是最終數字;兩邊不合時,帳單是對的。