Copilot CLI 不再算你問了幾次,改算你燒了多少 token
寫於 2026 年 8 月 11 日,9 月才上線(部落格的發佈額度 8 月 10 日就用完了,稿子積壓了三週)。文中對 Copilot CLI 的描述以 8 月 11 日的官方文件為準,你讀到時文件可能已經改版。
要把 Copilot CLI 排進日常,最該先算的是它怎麼收費。
因為從 2026 年 6 月 1 日開始,它的計費單位換了一種。換掉的那個東西,剛好會決定你按下 Enter 之前在想什麼。
聲明一下:Copilot CLI 我沒有拿真的專案跑過,以下都是查官方文件得到的,我會附上出處。真正有第一手經驗的是另外半邊,也就是我每天在用的 Claude Code,所以這篇的視角是「一個用訂閱制 agent 的人去看按量計費的 agent」。
舊制長什麼樣,以及為什麼你搜到的教學多半還在講它
舊制叫 premium request。規則簡單到一句話講得完,官方文件是這樣寫的:
Each prompt to Copilot CLI uses one premium request with the default model. For other models, this is multiplied by the model’s rate.
下一句才是關鍵:
For agentic features, only the prompts you send count as premium requests; actions Copilot takes autonomously to complete your task, such as tool calls, do not.
你送出去的提問算錢,它自己跑的 tool call 不算。Copilot Pro 一個月 300 次、Pro+ 一個月 1,500 次,用完之後還可以退回一個 included model 繼續撐到月底。
在這個規則下,理性的用法是:問題一次想清楚再問,然後放它去跑。它翻二十個檔案還是兩個檔案,對你的帳單沒有差別。
這頁文件現在的標題已經改成「Requests in GitHub Copilot (legacy)」。搜尋結果裡大量談 Copilot CLI 划不划算的文章都建立在這段規則上,而它從 6 月 1 日起只適用於在那之前就在年繳方案的舊訂戶。
新制把「自己跑」變成有價的行為
2026 年 4 月 27 日的公告寫得很直接:
Starting June 1, premium request units (PRUs) will be replaced by GitHub AI Credits.
Credits will be consumed based on token usage, including input, output, and cached tokens, according to the published API rates for each model.
換算基準是一個好記的數字:1 AI credit 等於 0.01 美元。你的 credits 就是照各模型公布的 API 費率,把 input、output、cached token 全部折算過來的。
方案這樣分。Copilot Pro 每月 10 美元,1,000 base credits 加 500 flex,合計 1,500。Pro+ 每月 39 美元,3,900 加 3,100,合計 7,000。另外還有一階 Copilot Max,每月 100 美元換 20,000 credits。企業端則是 Business 每人每月 19 美元含 1,900 credits、Enterprise 每人每月 39 美元含 3,900。
現在回頭看剛才那句「tool call 不計費」。它在新制底下不成立了,因為 tool call 的輸入與輸出都是 token。
差別有多實際?agent 之所以比聊天視窗有用,靠的就是它會自己去讀十個檔案、跑三次測試、翻一遍 git log。舊制對這件事收費為零,新制對這件事按秤計價。同一句「幫我看看這個 bug」,你丟在一個乾淨的小 repo 跟丟在一個十萬行的專案裡,帳單可以差好幾倍,而你送出的字數一模一樣。
額度用完的那一刻,行為也變了
舊制用完還有得用,退回較便宜的 included model 撐完當月。新制把這條路收掉了,官方公告的原文是:
Fallback experiences will no longer be available. Today, users who exhaust PRUs may fall back to a lower-cost model and continue working. Under the new model, usage will instead be governed by available credits and admin budget controls.
組織端如果允許 additional usage,超出的部分照公布費率繼續計費、帳單開給公司;不允許的話,直接停到下個週期。
這裡有一個管理員最好今天就去看一眼的預設值:additional usage 預設是開啟的。要不產生超額支出,得主動到 AI Controls 設定裡把 AI credits 的付費使用政策關掉。預設值站在「不要打斷你工作」那一邊,代價是它也站在「帳單可以長大」那一邊。
還有兩個容易誤會的小地方。credits 不遞延,沒用完就沒了;重置時間是每個月 1 號 UTC 00:00,跟你的訂閱扣款日無關。企業的 credits 是池化的,一家買了 100 個 Business 席次的公司拿到的是 190,000 credits 的共用池,不是 100 個各自 1,900 的獨立桶子。重度使用者可以多吃,輕度使用者剩下的自動補位。
一個訂閱制裡不存在的東西
Copilot CLI 有個指令叫 /limits,可以設 max-ai-credits——單一次回應能花掉的 credits 軟上限。
第一次看到我愣了一下。在訂閱制的心智模型裡,這個東西沒有意義,你不會替「這一句回答」設預算,因為每一句的邊際成本都是零,你只會感覺到「額度快用完了」這個模糊的壓力。
按量計費把那個模糊的壓力變成一個可以寫進設定的數字。差別在顆粒度:成本從按月感受,變成按每一次回應感受。人對這兩種顆粒度的反應差很多。
顆粒度細有細的好處。你會知道哪一種任務貴、會願意為省錢換模型、會替 CI 上跑的自動化設上限。顆粒度粗也有粗的好處,而且這個好處很少被講:你不會為了省錢而少給 context。
我自己的觀察是,用 agent 最常見的失敗來自資訊給得不夠,它判斷的依據太少。任何讓你下意識少貼一點、少讓它翻一點的機制,都在往錯的方向推。按量計費會不會造成這件事,取決於你是那種會看儀表板的人,還是那種看到數字跳動就開始節省的人。
那到底該選哪個
如果你的用法是每天問三五次、每次任務範圍明確、動到的檔案不多,按量計費會比訂閱便宜,而且便宜得有感。Pro 一個月 10 美元換 1,500 credits,等於 15 美元的 token 額度,小任務跑很久。
如果你是整天開著、動不動叫它把整個模組讀一遍、一個 session 跑好幾個小時那種,訂閱制的心理成本低太多了。省下來的其實是心力。你不用在每次要它「順便把測試也跑一下」之前,先在腦中算一下這句話多少錢。
企業導入的話,有兩件事我會擺在最前面。一是 additional usage 的預設值,開工前就要確認過。二是 credits 池化——它讓少數幾個重度使用者有辦法吃掉整個團隊的當月額度,而這件事在月底之前不會有人發現。
如果你打算兩邊都用,這件事得先知道
Copilot CLI 會直接讀你的 CLAUDE.md,也讀 .claude/CLAUDE.md 跟 GEMINI.md。聽起來很方便,但官方文件在講多份指令檔並存時寫了這麼一句:
…but does not define a general precedence order between these files.
沒有一般性的優先序。所有找到的指令檔會被合併,重複的會去掉。衝突的部分呢?官方直接建議你「避免衝突的指令」。
唯一存在的權重差異來自位置,不來自檔名。以 AGENTS.md 為例,放在 repo 根目錄的算 primary instructions,放在其他位置的算 additional。官方對這個差異的措辭是 “likely to have more effect”,用的是機率性的講法。
所以一個既有的 Claude Code 專案 clone 下來直接跑 copilot,你寫給 Claude 的規則會一起被吃進去,跟 AGENTS.md 混在一起,而誰贏沒有寫死。這不是不能用,是你得知道你在用什麼。
回到最前面那個問題,我的建議很直接:先量一次自己的用法。一個 session 平均開多久、一天叫它跑幾次、每次讓它翻幾個檔案。這三個數字答得出來,就選按量計費,你會省錢,也會第一次真正看清成本花在哪裡。答不出來就選訂閱,因為在你搞清楚自己怎麼用之前,按量計費只會讓你為了省錢養成錯的習慣。
參考來源:GitHub Copilot is moving to usage-based billing、Usage-based billing for individuals、Requests in GitHub Copilot (legacy)、Add custom instructions










