目錄
- 大量文字的工作,按量付費比較划算
- 用量會自己膨脹,你根本沒感覺
- 額度規則,比你想的還不透明
- 最後那張帳單,小心變成麻醉劑
- 大平台的算術,跟三人共享的封號地獄
- 額度到了,工作就停在那裡
- 「增加 4 倍」其實沒有 4 倍
- Pro 的額度其實很少
- Max 到底值不值
- Cowork 很燒 token,別用它替代 CLI
- 訂閱 cache reads 不計費
- 幾個實用工具
- 一個管理心態
- 夜市牛排跟餐廳牛排
- 訂閱制設計出來的焦慮
- 一個判斷框架
- 那要怎麼選?
- 美東尖峰時段:一小時就 hit limit
- Skill 沒解決 hit limit,反而帶來 shutdown
- 反觀免費版 GPT,至今未 hit limit
- 串起來看
- 補記:額度重置後自動繼續
- 併入:四條額度與定價的碎念
這幾個月關於「AI 用量」我陸陸續續留了幾條碎念,本來各自躺在碎念日記裡,湊起來才發現剛好是一套小小的「用量經濟學」——從怎麼付錢、用量怎麼自己膨脹、額度規則為什麼不透明,一路到月底那張帳單。乾脆收攏成一篇。
大量文字的工作,按量付費比較划算
只要用到大量文字的地方就會用到 OpenRouter,比如會議記錄整理。不過因為很 on-demand,而且都選量大便宜的模型,所以評估之後按量付費比較划算,儲值 10 USD 可以用好久。
訂閱制適合天天重度用固定那幾個模型;但如果你的重活是「偶爾一次、吃很多 token、又不挑最貴模型」,按量就不會浪費在你根本沒用到的額度上。
用量會自己膨脹,你根本沒感覺
tokenizer 重製才真的刺激,1.4x 用量。
你什麼都沒改,同樣一份工作,模型換個 tokenizer 用量就多出四成。這種膨脹不會寫在顯眼處,你是從額度消耗速度才後知後覺。
額度規則,比你想的還不透明
為什麼每個人的額度重置時間不一樣?因為如果重置同時重設時間,那所有人的重置時間會變得一樣,這樣子可能會導致大家有一樣的使用高峰:比如在週期快到的時候瘋狂用,可能會加重尖峰負載,導致伺服器不穩定,所以他們才刻意打亂,我猜是這樣。
每個人的 reset 時間都不一樣,有人禮拜天,有人禮拜三。這算是 Anthropic 的「需求平整」(demand smoothing)策略——讓週尖峰不會集中在一兩天。
另一個方向是併池。早起一則冷新聞:Claude Design 的獨立額度已經消失,併入整體 Claude 的使用額度中。獨立額度一個一個被收進主池,彈性是有了,代價是你更難精算「這個功能我到底還剩多少能用」。
最後那張帳單,小心變成麻醉劑
ccusage 歷史新高 +111%。當你把花費跟產出分開看,那個數字就不是「效率的代價」,是「被工具溺愛的帳單」。
用量會自己膨脹、額度規則不透明、模型又好用到讓人上癮——這三件事疊起來,月底那張帳單很容易被自己合理化成「這是生產力的代價」。但把花費跟產出分開看,常常會發現:你付的是被工具溺愛的錢,不見得是產能的錢。
大平台的算術,跟三人共享的封號地獄
只講事實,不評論個人:
各家的自家訂閱方案基本是最划算的,補貼的倍數甚至有 10~50 倍。舉個例子,我在 Claude 訂 100 USD,一個月可以用到 API 定額相當 5000 USD 的量。如果是設立路由大平台,那就很有可能只能走 API 定額……這樣真的好嗎?
同一天還有另一個版本的算術。三人共享,這是今天聽到最好笑的,比市長候選人的多個 AI 入口大平台更好笑。你是不是沒有用過 Claude,不知道三人共享=三人一起下封號地獄。
想從反方向體驗額度的,也有辦法:直接進 Claude Code 訂 6000 的方案,然後開 fable + ultracode,就可以體驗到不只是主管,甚至是老闆的感受。當然最先體驗到的是額度到了,薪水發不出來的感覺。
額度到了,工作就停在那裡
Claude Code 對我來說不是「偶爾用的工具」,是每天開機就在跑的工作環境。所以 Rate Limit 到了之後,那種落寞感是真實的——比網路斷線還難受,因為工作真的就停在那裡了。
這種依賴程度讓我非常在意額度。以下是幾個月下來摸清楚的事。
「增加 4 倍」其實沒有 4 倍
有人實測:5x 到 20x 的「增加 4 倍」其實只是五小時額度的 4 倍。週額度其實只有增加 2 倍。
Pay more, get less than expected。這不是個別感覺,是數學設計。如果你升級是為了「跑長時間的批次」,要先確認你真正需要的是五小時容量還是週容量。
這個差距很少被討論,但它影響的是你在「連續工作場景」和「長週期平均使用」這兩種情境下的實際體驗。如果你的工作節奏是每天短時間、分散使用,5x 方案對你的週額度改善其實有限。
Pro 的額度其實很少
很多人買 Pro 以為就夠用了。我的觀察是:如果你只是偶爾問問題,Pro 完全夠。但如果你開始跑 agent、讓 Claude 自主完成多步驟工作,Pro 的週額度很快就見底。
我自己在摸清這件事之前,兩天 extra usage 就燒了 20 USD,補購又燒了 20,最後直接升級了。
Max 到底值不值
Pro 到 Max,差距不只是額度量,是用起來的「質感」完全不同。Pro 下你會一直在算還剩多少,Max 下幾乎不需要想這件事。
我自己是先開 20x,覺得用量跟不上(AI 跑的時候我也在同時思考怎麼驗收、怎麼給下一個指令,並不是真的能 20x),後來退回 5x。大部分用 Sonnet,小部分用 Opus 做需要更深推理的任務。
100 美的 Max,平攤到每個工作天,對我來說是合理的工具成本。
Cowork 很燒 token,別用它替代 CLI
Cowork 是 Claude 的沙盒介面版本。它的 token 消耗比直接用 CLI 快很多,社群有人實測,差距相當明顯。原因有幾層:介面本身的 wrapper overhead、預設的 safety 注入、以及 context 管理的方式不同。
如果你在用 Cowork 然後覺得 Pro 根本不夠燒,切換到 CLI 之後會發現同樣的任務省很多。Cowork 的定位應該是入門體驗,不是正式工作環境。
訂閱 cache reads 不計費
這個很多人不知道:只有 API 計費才會對 cache reads 計費,訂閱方案的 cache reads 免費。
所以如果你有一份很長的 system prompt 或 CLAUDE.md,你的訂閱方案不會因為它被快取讀取而扣費。API 用戶就不一樣了——每次 cache hit 還是有小額的 read 費用。
幾個實用工具
ccusage:!npx ccusage@latest monthly 可以看詳細的 token 用量分析。如果你想知道自己的 token 花在哪,這個必裝。
Rate Limit Statusline:Claude Code 2.1.80 版本後,可以把 rate limit 剩餘顯示在 statusline(終端機底部的狀態列)。不用一直打 /usage 查了,用量一目瞭然。
有了這兩個工具,你對自己的用量節奏會有清楚很多的感知。當你知道距離下次重置還有多少時間、還剩多少額度,要不要踩油門心裡就有數。
一個管理心態
最後是比較偏哲學的一個想法:訂閱額度是有限的資源,但它的稀缺感不應該影響你的工作判斷。
我見過有人因為怕超量,把本來應該給 Claude 做的事情手動做,結果省了 token 卻浪費了自己的時間。額度買來是讓你節省時間的,不是讓你計算哪些任務「值不值得」消耗的。
剩 5 分鐘就重置但還有 10% 沒用完?趕快燒完。重置前你的額度是你的,不燒就浪費了。
夜市牛排跟餐廳牛排
有個問題我一直覺得有趣:
有兩百塊的夜市牛排,也有兩千塊的餐廳牛排。後者有比前者好吃十倍嗎?
幾乎不可能。但還是有人買單。原因很多:環境、服務、儀式感、可以帶客戶。這些都是牛排以外的東西。
AI 訂閱費也是一樣的邏輯,卻幾乎沒有人這樣思考它。
AI 訂閱費跟產出效益的比例,總感覺怪怪的。Sonnet 跟 Opus 的差價很大,但日常 80% 的工作 Sonnet 就夠用。升到 Opus Max 帶來的「真實生產力提升」並沒有等比例放大。
很多人付 Max 是付「焦慮稅」——怕用低配漏掉某個能力。但低配漏掉的多半不是能力,是耐心。
訂閱制設計出來的焦慮
Claude Max 週重置前,Threads 上會出現一種固定的慌亂。截圖:All models 使用率 92%,還有十小時才重置。留言:「不用完我睡不著覺。」「做夢都夢到在浪費 token。」
這不是個人問題,這是訂閱制的機制設計。月費加上使用上限,天然製造「不用完很虧」的感覺。跟健身房月票完全一樣——差別是健身房剩下的課算你身體,Claude 沒用完的算你智識焦慮。
這種焦慮本身,就是一個訊號:你可能在用一個你不應該用的方案。
一個判斷框架
我目前用這三個問題判斷一個 AI 訂閱方案是否「值得」:
1. 我用這個工具做的事,有沒有讓我做到本來做不到的事?
不是「讓我更快做完」,是「本來根本不會做、現在做到了」。這才是 10 倍價值的來源。
如果只是讓原本兩小時的工作變成一小時,那你在買的是效率,不是能力擴充。效率值多少錢,跟能力擴充值多少錢,是完全不同的計算。
2. 我有沒有在用這個工具解決它真正擅長的問題?
很多人買了 Claude Max,然後主要用來:改改句子、問幾個 Google 一搜就有的問題、或者做一些 GPT-4o free 版可以搞定的事。
這不是工具問題,是使用場景問題。夜市牛排跟餐廳牛排的差距,在你一個人吃飽就走的情境下幾乎是零。
3. 我的使用量有沒有真的碰到上限?
如果你從來沒碰過週限額,可能你用的是 Pro 方案就夠了。如果你每次到重置前都在衝量,那兩個情況:要麼你真的需要升,要麼你在用訂閱制的焦慮機制倒逼自己。
後者不是真的需要,是被設計出來的需要。
那要怎麼選?
我現在的實際配置:
- 寫文章、整理思路:Sonnet,medium effort。
- 一般程式任務:Opus 4.6,medium。
- 複雜架構、跨檔案分析:Opus 4.6,high/max。
- 4.7:目前個人感覺還沒顯著好過 4.6,先不急切換。
如果你的工作場景大量在前兩類,Pro 方案加上聰明的 session 管理,通常就夠了。真的需要大量高強度使用才是 Max 的適用場景。
訂閱費值不值,不是問「這個工具好不好」,是問「你有沒有在用對地方」。
夜市牛排好不好吃,端看你為什麼去夜市。
美東尖峰時段:一小時就 hit limit
最近實測:以目前的方案加上美東尖峰時段,你大概會在 1 小時後 hit limit。
這代表訂閱的「真實可用容量」跟你買的「名義容量」之間有時差——尖峰時段名義容量會被分母稀釋。
實務上的對策:把重要工作排在台北時間早晨(北美深夜離峰)做。這也意外解釋了為什麼最近 Claude 在亞洲時區反而比較好用。
Skill 沒解決 hit limit,反而帶來 shutdown
Skill 比較不像是不同部門,更像是操作手冊。
長期使用的話,三天兩頭 shutdown,不 shutdown 的話就是 hit limit。Skill 不是節省 token,是換一種方式把 token 用掉——Skill 載入本身就要費 token,而且更容易把長 context 撐到上限。
如果你 hit limit 的頻率變高,先檢查是不是被 Skill 拖的。
反觀免費版 GPT,至今未 hit limit
我用免費版 GPT 至今還沒 hit limit。
問題不是免費版多強,是付費的 Claude 讓我太常 hit limit 了。Claude 用戶的「滿足度」跟「焦慮度」一起拉高——比起免費 GPT 用戶在「能用就好」的滿足區,Claude 用戶長期活在「下個小時還能用嗎」的計時區。
串起來看
把這幾條串在一起,會看到 Anthropic 的訂閱設計邏輯:
- 打散需求避免基礎設施失靈
- 方案結構讓你升級時感覺很多但實際拿到較少
- 尖峰稀釋讓真實容量比名義容量低
- Skill 等新功能讓你燒得更快
- 付費焦慮反過來成為留存機制
這是個成熟的訂閱經濟模型,不是單純的「容量分級」。理解這個結構,可以幫你決定:
- 我升 Max 的理由是「容量」還是「焦慮」?
- 我 hit limit 的真正原因是什麼?
- 我可不可以靠時段選擇 + 工具分工把問題壓下去?
工具是好工具,但你要知道你在買的是什麼。
補記:額度重置後自動繼續
應該是前幾天的版本吧,終於有這個功能了:額度重置後自動繼續。真的太好了。但是其實我心裡更希望的是一小時以上的 Cache 能夠留著。
併入:四條額度與定價的碎念
/low-priority 可以在五小時額度打滿後讓你繼續用,只是比較慢,因為用的是離峰算力。同樣會吃週額度。這是看 Reddit 才學到的。
Codex 那邊,Tibo 預告 back-to-back reset 意外讓我實測出 20USD 方案 5h 窗口跟 7d 窗口的關係:7d 額度大概等於 5 輪 5 小時窗口再多一點。想認真用滿額度,從宣佈後就開始猛用是個好選擇。
按量付費這一側,GPT-5.6-Luna 便宜到有點荒謬。我目前接在兩個地方:類似沈浸式翻譯的網頁外掛,每天約 50-80 個外語網頁一鍵全翻譯;類似 Typeless 的語音輸入法「Say It」,每天約 100-150 次使用做文字整理。10 天下來每天花費不到 0.01 美元,費用儀表板顯示是 0.0。
另一個方向的冷知識:目前為止 API 定價最貴的模型並不是 Claude Fable,是 GPT-o1-pro,150/600,約為 Fable/Mythos 的 12-15 倍(10/50)。2025 年 3 月發佈,目前為棄用但仍未退役狀態。