← 返回首页目录
# Models and Pricing for GitHub Copilot

**作者:吉祥法师**

GitHub Copilot 的模型定价体系遵循 AI 信用点(AI Credits)模式,其中 1 AI 信用点等于 0.01 美元。用户在 Copilot 的使用过程中,每次交互会消耗三类令牌:输入令牌(发送给模型的内容)、输出令牌(模型生成的内容)以及缓存令牌(模型复用或存储的上下文信息)。不同模型的令牌价格各不相同,其总消耗量最终会折算为 AI 信用点用于计费。

## 计费模式的核心逻辑

Copilot 的使用与计费方式主要取决于用户所属的计划类型。对于个人计划,包括 Copilot Free、Pro、Pro+ 和 Max,均包含不同数量的 GitHub AI 信用点配额。而 Copilot Business 和 Copilot Enterprise 计划则包含按用户分配的 AI 信用点,并在账单主体层面进行池化处理。无论何种计划,一旦使用量超出所包含的配额,系统将按照每 1 百万令牌的费率表,以 AI 信用点为单位对额外部分进行计费。

需要注意的是,如果用户通过 iOS 或 Android 上的 GitHub Mobile 应用订阅了 Copilot 计划,则无法购买额外的 AI 信用点。

## 各模型定价明细(每 1 百万令牌)

### OpenAI 系列模型

OpenAI 系的模型在定价表中展示了多种型号的详细费率。具有 **Long context(长上下文)** 层级的模型提供扩展能力和更大的上下文窗口。值得注意的是,GPT-5.6 Luna、GPT-5.6 Terra、GPT-5.6 Sol 和 GPT-6 Astra 在缓存输入(Cached input)之外还包含缓存写入(Cache write)成本,而早期的 OpenAI 模型则没有这项费用。各模型根据能力从“Lightweight(轻量级)”到“Versatile(全能型)”再到“Powerful(强大型)”进行分级。

| 模型 | 类别 | 层级 | 输入令牌阈值 | 输入($) | 缓存输入($) | 缓存写入($) | 输出($) |
|------|------|------|------------|---------|------------|------------|---------|
| GPT-5 mini | 轻量级 | 默认 | 不适用 | 0.25 | 0.025 | 不适用 | 2.00 |
| GPT-5.3-Codex | 强大型 | 默认 | 不适用 | 1.75 | 0.175 | 不适用 | 14.00 |
| GPT-5.4 | 全能型 | 默认 | ≤272K | 2.50 | 0.25 | 不适用 | 15.00 |
| GPT-5.4 | 全能型 | 长上下文 | >272K | 5.00 | 0.50 | 不适用 | 22.50 |
| GPT-5.4 mini | 轻量级 | 默认 | 不适用 | 0.75 | 0.075 | 不适用 | 4.50 |
| GPT-5.4 nano | 轻量级 | 默认 | 不适用 | 0.20 | 0.02 | 不适用 | 1.25 |
| GPT-5.5 | 强大型 | 默认 | ≤272K | 5.00 | 0.50 | 不适用 | 30.00 |
| GPT-5.5 | 强大型 | 长上下文 | >272K | 10.00 | 1.00 | 不适用 | 45.00 |
| GPT-5.6 Luna | 轻量级 | 默认 | ≤200K | 0.20 | 0.02 | 0.25 | 1.20 |
| GPT-5.6 Luna | 轻量级 | 长上下文 | >200K | 0.40 | 0.04 | 0.50 | 1.80 |
| GPT-5.6 Sol | 强大型 | 默认 | ≤272K | 4.00 | 0.40 | 5.00 | 20.00 |
| GPT-5.6 Sol | 强大型 | 长上下文 | >272K | 8.00 | 0.80 | 10.00 | 30.00 |
| GPT-5.6 Terra | 全能型 | 默认 | ≤272K | 2.00 | 0.20 | 2.50 | 12.00 |
| GPT-5.6 Terra | 全能型 | 长上下文 | >272K | 4.00 | 0.40 | 5.00 | 18.00 |
| GPT-6 Astra | 强大型 | 默认 | ≤272K | 10.00 | 1.00 | 12.50 | 50.00 |
| GPT-6 Astra | 强大型 | 长上下文 | >272K | 20.00 | 2.00 | 25.00 | 75.00 |

### Anthropic 系列模型

Anthropic 的全部模型除了缓存输入费用之外,同样包含缓存写入成本。该系列涵盖 Claude Haiku、Sonnet 和 Opus 等多个型号,根据尺寸和功能定位的差异分布在“全能型”和“强大型”两个类别中。其中 Claude Opus 4.8(快速模式,预览版)和 Claude Fable 系列在定价上定位较高。值得注意的是,强大型模型的输入费率通常为 5.00 美元/百万令牌,输出费率则达到 25 至 50 美元不等,反映出其更强的复杂任务处理能力。

| 模型 | 类别 | 输入($) | 缓存输入($) | 缓存写入($) | 输出($) |
|------|------|---------|------------|------------|---------|
| Claude Haiku 4.5 | 全能型 | 1.00 | 0.10 | 1.25 | 5.00 |
| Claude Sonnet 4 | 全能型 | 3.00 | 0.30 | 3.75 | 15.00 |
| Claude Sonnet 4.6 | 全能型 | 3.00 | 0.30 | 3.75 | 15.00 |
| Claude Opus 4.7 | 强大型 | 5.00 | 0.50 | 6.25 | 25.00 |
| Claude Opus 4.8 | 强大型 | 5.00 | 0.50 | 6.25 | 25.00 |
| Claude Opus 5 | 强大型 | 5.00 | 0.50 | 6.25 | 25.00 |
| Claude Sonnet 5 | 全能型 | 2.00 | 0.20 | 2.50 | 10.00 |
| Claude Opus 4.8(快速模式) | 强大型 | 10.00 | 1.00 | 12.50 | 50.00 |
| Claude Fable 5 | 强大型 | 10.00 | 1.00 | 12.50 | 50.00 |
| Claude Fable 5.1 | 强大型 | 10.00 | 0.25 | 12.50 | 50.00 |

### Google 系列模型

Google 系列的三款闪存型号——Gemini 3.6 Flash、3.7 Flash 和 3.8 Flash——目前处于促销定价期,均为每百万输入令牌 0.75 美元,每百万缓存输入令牌 0.075 美元,每百万输出令牌 3.75 美元。这一优惠价格将持续至 2026 年 12 月 31 日。与此相比,Gemini 3.5 Flash 的定价显得更高,输入费率为每百万令牌 1.50 美元,输出费率为 9.00 美元。同样,支持长上下文层级的模型在扩展窗口后费率会相应提升。

| 模型 | 类别 | 层级 | 输入($) | 缓存输入($) | 输出($) |
|------|------|------|---------|------------|---------|
| Gemini 3.5 Flash | 轻量级 | 默认 | 1.50 | 0.15 | 9.00 |
| Gemini 3.6 Flash | 全能型 | 默认 | 0.75 | 0.075 | 3.75 |
| Gemini 3.7 Flash | 全能型 | 默认 | 0.75 | 0.075 | 3.75 |
| Gemini 3.8 Flash | 全能型 | 默认 | 0.75 | 0.075 | 3.75 |

### Microsoft 与 xAI 等比模型

Microsoft 的 MAI-Code-1-Flash 和 MAI-Code-1.1-Flash 均属于轻量级模型,其中 MAI-Code-1.1-Flash 的定价明显更为低廉,输入费用为每百万令牌 0.20 美元。xAI 的 Grok 模型同样提供长上下文层级,超过 200K 输入令牌阈值后费率翻倍。Moonshot AI 的 Kimi 系列中的 Kimi K2.7 Code 和 Kimi K3 被分别归类于全能型与强大型模型。

| 模型 | 类别 | 层级 | 输入令牌阈值 | 输入($) | 缓存输入($) | 输出($) |
|------|------|------|------------|---------|------------|---------|
| MAI-Code-1-Flash | 轻量级 | 默认 | 不适用 | 0.75 | 0.075 | 4.50 |
| MAI-Code-1.1-Flash | 轻量级 | 默认 | 不适用 | 0.20 | 0.02 | 1.20 |
| Grok 4.5 | 全能型 | 默认 | ≤200K | 2.00 | 0.50 | 6.00 |
| Grok 4.5 | 全能型 | 长上下文 | >200K | 4.00 | 1.00 | 12.00 |
| Grok 4.6 | 全能型 | 默认 | ≤200K | 2.00 | 0.50 | 6.00 |
| Grok 4.6 | 全能型 | 长上下文 | >200K | 4.00 | 1.00 | 12.00 |
| Kimi K2.7 Code | 全能型 | 默认 | 不适用 | 0.95 | 0.19 | 4.00 |
| Kimi K3 | 强大型 | 默认 | 不适用 | 3.00 | 0.30 | 15.00 |

## 代码补全的特殊计费规则

代码补全(Code completions)和下一步编辑建议(next edit suggestions)功能不按 AI 信用点计费。所有付费 Copilot 计划均包含不限量的代码补全服务,并沿用既有的计数机制。

## Copilot 代码审查的计费与用量考量

### 模型选择的不透明性

对于大多数 Copilot 功能,用户可以清楚地看到每次交互所使用的模型,从而参考定价表估算成本。然而,Copilot 代码审查功能存在一个显著的例外——该功能所使用的模型是自动选择且不对外披露的。这意味着不同次审查之间,每令牌的成本可能存在差异,用户难以精确预估单次审查的实际开销。

### 双重计费体系

每次代码审查的运作成本通过两条独立的路径进行计费。一方面,令牌消耗量按 AI 信用点计费,另一方面,支撑审查运作的代理基础设施会消耗 GitHub Actions 分钟数。GitHub Actions 分钟数归属于代码仓库,并进一步归属到企业或对应的成本中心。AI 信用点则向发起审查请求的个人收费,或者在策略自动触发审查的情况下向拉取请求的作者收费。如果该人员并未持有 Copilot 席位,那么使用量将转而计入企业或成本中心名下。

### 机器人作者的特殊归属原则

当拉取请求由 Copilot 云代理创建时,使用量首先归属于与该变更关联的人类共同作者。如果共同作者无法承担计费,使用量将直接计入组织名下。对于其他机器人创建的拉取请求,或由机器人请求的审查,使用量同样直接归属于组织。此类拉取请求符合代理审查的适用资格。

### 用量查询方式

用户可以通过两种主要途径查看当前 GitHub Actions 的使用情况。在 GitHub Actions 指标中,可按 `copilot-pull-request-reviewer` 工作流进行筛选;在计费使用报告中,则可通过 `workflow_path` 字段并筛选值为 `dynamic/agents/copilot-pull-request-reviewer` 的记录进行查询。

## 年度订阅计划的模型倍率

对于采用基于请求计费模式且处于现有年度计费计划的 Copilot Pro 和 Copilot Pro+ 订阅用户,其适用的模型倍率与传统计费模式有所不同。相关内容可在“基于请求计费(旧版)的年度计划模型倍率”中查阅详细说明。

## 脚注与推广说明

Gemini 3.6 Flash、Gemini 3.7 Flash 和 Gemini 3.8 Flash 目前以促销价格提供,有效期为自定价日起至 2026 年 12 月 31 日止。在此期间,其输入、缓存输入及输出费用均为上述优惠费率,期满后将恢复标准定价。