它是什么
模型切分文本后的最小计量单位,介于字符与词之间;长度、计费和响应开销都按它算。
为什么重要
看懂 token 就能解释两件很实际的事:为什么中文往往比英文更费额度,以及为什么同样的需求换个说法价格就变了。
打个比方
像拼装乐高的小积木:模型不认识完整句子,只认识一盒盒形状固定的零件,长文章就是数量庞大的零件堆。
举个例子
同一段需求,中文版往往比英文版占用更多 token;把一次长对话导出后统计一下,就能发现「请你把下面这段翻译成英文」比逐字润色便宜得多。
常见误解
误解:一个 token 就是一个字或一个词。 事实:它由模型自带的分词器切分,英文里一个词常拆成两三个,中文一个字也可能占两个 token。
误解:token 只用来算钱。 事实:它同时决定上下文窗口能装下多少内容,也是响应快慢的重要来源。
误解:标点和空格不占 token。 事实:它们同样被切分计入,长文本里每省一点都算得出来。
误解:中文一定比英文贵。 事实:多数模型对中文的切分效率并不差,关键是把需求说精简,而不是机械地换成英文。
延伸阅读(相关概念)
本页内容更新于 2026 年 9 月 3 日。概念条目会随模型能力变化而修订。