有据可查的 AI 新闻、模型与产品English
指南 基础知识 · 第 3 章

AI 怎么收费

免费版、月度订阅、企业版和按 token 计费的 API 各是怎么回事,一份文档到底花多少钱,什么时候值得付费。

五种付费方式

AI 产品的收费方式看着五花八门,其实就这几类。同一家公司往往几种并存。

方式 怎么付钱 适合谁 要注意
免费版 不付钱,注册即用 日常问答、偶尔写点东西 用量少,新模型和高级功能常常用不了;部分产品的免费版有广告
个人订阅 每月固定费用,按年付通常更便宜 每天都用、经常碰到免费额度上限的人 「无限」往往有附加条件,所有方案都有用量上限
团队 / 企业版 按人头(席位)每月付费,有的再加实际用量费 公司、团队 有管理后台,默认不拿工作内容训练模型(见隐私与安全)
API 按量付费 先充值或绑卡,按 token 用量扣费 写程序、做产品的开发者 没有月费,但用得越多付得越多,要设好消费上限
额度 / 积分 买一个额度池,各功能按消耗扣除 偶尔超出订阅上限的人;图片、视频、智能体类产品 消耗速度取决于任务大小,事先很难准确预估

token:AI 的计价单位

token(中文常译作「词元」)是模型读写文字时切分出来的小片段。一个常见的短英文单词通常是 1 个 token,长单词会被拆成几块,标点和空格也会占位置。API 按 token 计费,订阅的用量上限背后也是 token。

一个 token 大概是多少字?各家官方文档给的都是经验值,而且主要针对英文:

来源 官方说法
OpenAI 开发者文档 英文中 1 个 token 约等于 4 个字符,或 0.75 个单词
Anthropic(Claude)价格文档 英文中 1 个 token 约 4 个字符或 0.75 个单词;实际数量随语言和内容而变
Google Gemini API 文档 1 个 token 约 4 个字符;100 个 token 约等于 60 到 80 个英文单词
DeepSeek API 文档 1 个英文字符约 0.3 个 token,1 个中文字符约 0.6 个 token;不同模型的分词不同,比例也不同

中文要特别小心。 上表里只有 DeepSeek 给了中文的换算比例,而且它明确说这只适用于自家模型。OpenAI、Anthropic、Google 的文档只给了英文的经验值。同一段中文放进不同模型,算出来的 token 数可能差不少。

同一家公司的不同模型也会不一样。Anthropic 的价格文档写明:Claude 4.7 及之后的模型换了新的分词器,同样的文字大约多出 30% 的 token。所以,想知道准确数字,用官方提供的 token 计数工具,或者看每次调用返回的用量记录,比任何换算公式都可靠。

查 token 这个词的简短解释,也可以看术语表。

输入、输出和缓存

API 账单通常分三项,单价相差很大:

  • 输入 token:你发给模型的所有内容,包括问题、上传的文档、之前的对话记录和系统设定。多轮对话时,前面的内容每次都会重新发送,所以对话越长,每一轮的输入越多。
  • 输出 token:模型写出来的内容。它比输入贵得多,在 Claude 的价目表上是输入单价的 5 倍。会「先思考再回答」的推理模型,思考过程也算输出:Google 的价格表就把输出价格注明为「含思考 token」。
  • 缓存 token:如果你反复发送同一大段内容(比如同一份长文档),服务商可以把它暂存起来,下次读取只收很低的价钱。以 Claude 为例,第一次写入缓存要付 1.25 倍输入价(有效期 5 分钟),之后每次读取只要输入价的一小部分。
Claude Sonnet 5.5 输入(每百万 token)
$2
Claude Sonnet 5.5 输出(每百万 token)
$10
Claude Sonnet 5.5 缓存读取(每百万 token)
$0.10
批量处理(不急的任务)
−50%

来源:Claude API 价格文档,2026 年 10 月 8 日查询。价格会调整,请以官方页面为准。

算一笔账:用 API 总结一份 20 页的文档

下面用 Claude 的官方价目表算一遍。假设是一份 20 页的英文报告,每页约 500 个单词,你让模型写一页左右的摘要。

从页数到账单
  1. 1估算字数20 页 × 500 词 = 约 10,000 个英文单词。
  2. 2换算成 token按官方经验值 1 token ≈ 0.75 词:10,000 ÷ 0.75 ≈ 13,300 个 token。新分词器约多 30%:≈ 17,300。加上你的指令,取整按 18,000 个输入 token 算。
  3. 3估算输出一页左右的摘要,按 1,000 个输出 token 算。
  4. 4乘以单价费用 = token 数 × 单价 ÷ 1,000,000。

以 Claude Sonnet 5.5(输入 2 美元、输出 10 美元 / 每百万 token)为例:

  • 输入:18,000 × 2 ÷ 1,000,000 = 0.036 美元
  • 输出:1,000 × 10 ÷ 1,000,000 = 0.010 美元
  • 合计约 0.046 美元,不到 5 美分。

换成同一价目表上的其他模型:

总结一份 20 页英文文档的 API 费用18,000 个输入 token + 1,000 个输出 token;单位:美分
  • Claude Haiku 5.50.23 美分
  • Claude Sonnet 5.54.6 美分
  • Claude Opus 5.59.2 美分

按标准价计算:Haiku 5.5 为 0.10 / 0.50 美元(提示不超过 10 万 token 时),Opus 5.5 为 4 / 20 美元,每百万输入 / 输出 token。 来源:Claude API 价格文档,2026 年 10 月 8 日查询。

如果接着追问 10 个问题呢? 每问一次,整份文档都要重新作为输入发送。仍以 Sonnet 5.5 计算,假设每个回答约 500 个 token:

不用缓存 用缓存(5 分钟内连续提问)
文档部分 10 次 × 18,000 × 2 美元 ÷ 100 万 = 0.36 美元 第一次写入:18,000 × 2.5 美元 ÷ 100 万 = 0.045 美元;之后 9 次读取:162,000 × 0.10 美元 ÷ 100 万 ≈ 0.016 美元
回答部分 5,000 × 10 美元 ÷ 100 万 = 0.05 美元 0.05 美元
合计 约 0.41 美元 约 0.11 美元

两点结论:一是单份文档的 API 成本其实很低,贵的是大量、反复的调用;二是长对话里,真正花钱的往往是被反复发送的上下文,而不是你新打的那一句话。这些是估算,实际 token 数以接口返回为准。

三家主流助手的个人方案

下表只列我们在官方页面上核实过的价格,截至 2026 年 10 月,均为美元、不含税。各地区价格可能不同,通过手机应用商店订阅也可能不一样,请以官网为准。

档位 ChatGPT Claude Google AI(Gemini)
免费 有;官方称文字对话不限次(受防滥用规则约束),但上传、图片、深度研究等有限额 有 有
入门 Go(价格见官网,可能含广告) — Google AI Plus:4.99 美元 / 月,用量为免费版 2 倍
标准 Plus:20 美元 / 月 Pro:20 美元 / 月(按年付合 17 美元 / 月),用量至少为免费版 5 倍 Google AI Pro:19.99 美元 / 月,用量为免费版 4 倍
重度 Pro:100、200、500 美元 / 月三档 Max:100 美元 / 月起,用量为 Pro 的 5 倍或 20 倍 Ultra:99.99 美元 / 月(Pro 的 5 倍)或 199.99 美元 / 月(20 倍)
团队 Business:每人 20 美元 / 月(按年付)或 25 美元(按月付),2 人起 Team 标准席位:每人 20 美元 / 月(按年付)或 25 美元(按月付) Gemini Enterprise 商业版:每席 21 美元 / 月起

官方页面:ChatGPT(月费数字取自 OpenAI 开发者文档中的 Codex 价格页)、Claude、Google AI。各产品的详细介绍见本站的 ChatGPT、Claude 和 Gemini 产品页。

国产助手:基础功能大多免费

在国内常用的几款助手,基础对话一般不需要付费,收费主要集中在智能体、长任务和生成类功能上:

  • DeepSeek:网页版和 App 可以免费使用;它的 API 按 token 计费,价格页还区分了高峰和非高峰时段(非高峰半价)。
  • 豆包:据 TechNode 2026 年 5 月报道,字节跳动开始测试三档付费订阅,面向做 PPT、数据分析、视频等高算力用途;公司表示免费版会继续提供日常基础使用,付费方案仍在测试,以官方渠道公布为准。
  • Kimi:官方帮助中心列出四档会员,每月 49 元、99 元、199 元和 699 元,按年付更便宜。会员的各项功能共用一个额度池,按实际 token 消耗扣除,额度每月刷新、不结转,用完可以开「加油包」按量付费。

千问(通义)等其他产品的收费规则,请以官网为准。

单价便宜,不等于做事便宜

比较 API 价格时,人们常盯着「每百万 token 多少钱」。但你真正关心的,是把一件事做成要花多少钱。影响它的至少有三点:

  1. 同一件事,不同模型用的 token 数不同。 Anthropic 称,Opus 5.5 的 API 单价比 Opus 5 低(输入从 5 美元降到 4 美元),同时完成同样工作用的 token 更少,两者叠加,典型使用成本下降约 40%(见Opus 5.5 的报道)。Sonnet 5.5 的单价和上一代 Sonnet 5 完全一样,但官方称多数任务的成本最多能降 30%,原因同样是 token 用得更少(见Sonnet 5.5 的报道)。
  2. 分词方式不同。 前面提到,Claude 的新分词器数同样的文字会多出约 30% 的 token。两家单价一样,账单也可能不一样。
  3. 做错了要重来。 便宜的模型如果需要三次才能做对,加上你检查和返工的时间,未必比一次做对的贵模型省钱。Anthropic 在一个改写软件的内部测试中报告,Opus 5.5 完成同一任务的花费比更贵的 Fable 5.1 少 51%。这是厂商自己的测试,但说明了一个道理:算总账,不算单价。

实用的做法:拿你自己真正要反复做的一类任务,在两三个模型上各跑几次,记下成功率、等待时间和包括重试在内的总花费,再决定用哪个。

什么时候值得付费

先用免费版。出现下面这些情况,再考虑升级:

  • 经常碰到上限,一天要等好几次额度重置,影响正事。
  • 需要更强的模型或特定功能:比如处理很长的文件、深度研究、让 AI 操作电脑,或者写代码(Claude Code 包含在 Claude 所有付费方案中;ChatGPT 付费方案的 Codex 用量也比免费版多)。
  • 用于工作:涉及公司资料时,团队版或企业版的数据条款通常更合适,这一点比多出来的额度更重要。

几个省钱的习惯:

  • 先只订一家。 主流方案的标准档价格接近,同时订三家往往是浪费。用一两个月,确认真的离不开再说。
  • 按月付先试,确定后再按年付。 Claude 官方页面显示,Pro 按年付比按月付便宜约 15%。
  • 重度用户先算账。 如果一个月只有几天用得特别多,额度或按量付费可能比直接升到 100 美元以上的档位划算。
  • 开发者设好消费上限,并留意缓存和批量处理:Claude、OpenAI 和 Google 的 API 都对不急的批量任务提供约五折价格。
  • 记得取消。 订阅默认自动续费;通过苹果或安卓应用商店订阅的,要在应用商店里取消。

来源