6 月 1 日起,GitHub Copilot 把计费方式翻了个底朝天:从过去"一个席位随便用"改成按 AI Credits 按量算。官方说基础订阅价不变,听着像没事,但真正的变化藏在底下——从这天起,决定你账单的不再只是你写了多少代码,还有你这条网稳不稳。
这话听着别扭,却是新计费下国内开发者最该先搞明白的一件事。先把规则拆清楚,再说怎么少花冤柉钱。
Copilot 新计费:6 月 1 日到底改了什么
核心就一句:从"按次数 / 按席位"变成了"按 token"。你每次让 Copilot 补全、对话、跑 agent,背后都在消耗 token——发给模型的输入 token、模型吐回来的输出 token、还有复用上下文的缓存 token。这些 token 按各家模型的单价折算成 AI Credits,而 1 个 AI Credit 等于 0.01 美元。
从"随便用"到"用多少算多少"
老模型里,Copilot Pro 给你每月 300 个 premium request,超了按每次 0.04 美元加钱,大多数人月底根本用不完,体感就是"包月随便造"。新模型把这套换成了 credit 池子:每月给一份额度,token 烧到哪算到哪,池子见底了要么停在基础模型上继续用,要么自己设预算掉钱续。
老模型和新模型,差在哪
把两套并排放一起,差异一目了然:
| 维度 | 老模型(premium request) | 新模型(AI Credits,6/1 起) |
|---|---|---|
| 计量单位 | 按"请求次数" | 按 token 折算 credit(1 credit=$0.01) |
| Pro 月度额度 | 300 次 premium request | 一份月度 credit 额度,按 token 消耗 |
| 超额怎么收 | 每次 $0.04 | 按各模型每百万 token 单价计 |
| 用不完会留到下月吗 | 每月重置 | 每月重置,不结转 |
| 什么最烧 | 请求次数多 | 上下文大 + 重复请求(token 翻倍) |
注意最后一行,这是新旧两套逻辑最大的分水岭,也是后面那笔冤柉钱的根源。
额度怎么算、怎么知道自己用了多少
token 折算 credit 这件事,普通人不必去背每个模型的单价,但有三条规则得记住。
第一,贵的不是你打了多少字,是上下文有多大。一次请求里,模型要把你整个对话历史、打开的文件、相关代码一起当输入 token 读进去,你那句问话本身可能就几十个 token,真正的大头是后面拖着的一长串上下文。会话越长、塞的文件越多,单次越贵。
第二,额度每月清零,不结转。这个月没用完的 credit 不会攒到下个月,所以也别想着"省着点囤起来"。
第三,超额默认未必能花。2025 年 8 月 22 日之前建的账号,默认预算是 0,意思是额度烧完直接卡住,不会偷偷给你扣钱——你得自己去账单设置里把预算打开,才会继续按 token 计费。这条对老账号尤其重要,不然你可能正纳闷怎么补全突然不动了。
想知道自己烧到哪一步,别靠感觉。GitHub 账号的 Billing 页面里有一块专门的 Copilot 用量,能看到这个计费周期已经消耗了多少 credit、还剩多少。养成隔几天瞑一眼的习惯,比月底收到账单才发现超支强得多。真正重度用 agent 模式的人,建议直接把这一页加进书签。
举个直观的例子:一次干净利落的短补全,可能就消耗个位数的 token;而开着 agent 让它读十几个文件、跑一长串多轮任务,单次输入 token 轻松上万。前者的成本几乎可以忽略,后者才是真正吃额度的大户。把钱花在刀刃上的前提,是你得分得清这两类请求,别拿杀鸡的活去用宰牛的模型和上下文。
为什么国内开发者更容易把 Copilot 额度烧超
讲到这里才是重点。同样写一天代码,网络稳的人和网络飘的人,新计费下花的钱可能差出一截。原因有两个,都跟 token 重复计费有关。
重试和超时,在悄悄重复扣 token
老模型按次数算,你一个请求超时了重发一次,顶多多记一次 request,无伤大雅。新模型不一样:你重试一次,等于把那一大坠上下文 token 又完整喂了一遍,token 翻倍,credit 跟着翻倍。连接一飘,补全失败重来、agent 任务跑一半断了重跑,这些在账单上都是实打实的二次消耗。换句话说,过去网络差只是浪费你的时间,现在还顺手浪费你的钱。
长上下文撞上不稳定连接,浪费翻倍
Copilot 的 agent 模式、长会话本来上下文就大,单次 token 消耗高。这种重请求一旦摄上跨境链路抖动,中途断流的概率比短补全高得多,而每断一次重来,烧掉的都是高 token 的大请求。上下文越大、网越飘,这个浪费的乘数效应越明显。
少烧额度,几个能立刻上手的做法
规则摸清了,省钱反而简单。下面这几条,优先级从高到低:
- 先把连接做稳,这是性价比最高的一步——重试少一次,就少烧一份上下文 token,稳定直连省下的是真金白银
- 该开新会话就开,别让一个对话拖到几百轮,上下文越短单次越便宜
- agent 这类重任务尽量在网络稳的时段跑,避开晚高峰断流
- 老账号去账单页确认一下预算设置,想兜底就设个上限,别等额度烧完才发现
- 简单补全用基础模型就够,把 credit 留给真正需要强模型的活
按 token 计费这套,短期内不会再变回去,各家 AI 编程工具大概率也会跟进同一个方向。这意味着"网络稳定性"从一个体验问题,正式变成了一个成本问题——对天天靠 Copilot、Claude Code、Cursor 干活的人来说,把那条跨境路走顺,省下的早就不止是等待的几秒钟了。







