SPT术语库

Token

用户把一段中文需求和代码标识发给 AI,应用先把输入拆成 token,再显示它占用了多少上下文以及本次输入的估算费用。

AI 与智能体约 10 分钟 · 从真实需求理解

1Token 到底是什么,为什么会影响费用?

TOKEN · SPLIT + COUNT + METER输入不是一整块,模型会把它切成片段

切分结果影响上下文占用,也参与 API 用量估算。

TEXT → TOKENS → USAGE
INPUTRAW CONTENT
请把 checkoutButton 放大,避免误触。
TOKEN SEGMENTSWAITING TO SPLIT
请把 checkoutButton 放大避免误触

边界由具体 tokenizer 决定,不是固定的一字一 token。

CONTEXT USED— / 32 tokens
累计片段后计算
INPUT COST · ESTIMATEWAITING
等待 token 计数模型价格条件尚未带入

Token 是模型处理文本、图片等输入输出时使用的片段单位。你输入一句话后,系统通常不会把它当成一个完整的“字”或“词”,而会按自己的 tokenizer 切成若干片段,再用这些片段计算上下文占用和 API 用量。

  • 中文、英文、代码标识和标点可能有不同的切分方式,所以 token 数不等于字数。
  • 输入和输出都会消耗 token;token 越多,越接近上下文容量,也可能带来更高费用。
  • 不同模型的 tokenizer 和价格可能不同,页面上的切分与费用只能按当前模型规则估算。

2Token 不是字数,也不是固定的一词一 token

“这句话有多少字”不能直接回答“会用多少 token”。模型使用的 tokenizer 可能把一个英文标识拆成几段,也可能把常见片段合并;中文、空格、标点和代码的结果也可能不同。

  • Token 是模型内部处理和计量的片段,不是人类阅读时的字、词或句子。
  • 上下文窗口表示最多能放多少 token,Token 本身是被放进去并计量的单位。

因此,比较费用或容量时要看具体模型和 tokenizer 的估算结果,不要用固定的“几个字等于一个 token”当成通用规则。

3一次 Token 计量由哪些部分组成?

INPUT请把 checkoutButton 放大
TOKEN SEGMENTS
请把checkoutButton放大
CONTEXT USED8 / 32
INPUT COST约 $0.0008

拆开一次输入计量,可以看到原始输入、token 片段、上下文占用和费用提示四个部分。它们把“我输入了一句话”连接到模型实际接收了多少可计量内容。

  • INPUT 是用户看到的完整文字或其他输入内容。
  • TOKEN SEGMENTS 是 tokenizer 切出的片段,边界由模型规则决定。
  • CONTEXT USED 汇总输入和已有上下文消耗了多少容量。
  • INPUT COST ESTIMATE 根据模型价格和 token 数给出费用提示,必须标明估算条件。

4怎样把 Token 需求交给 Agent?

请做一个 Token 教学示例:输入‘请把 checkoutButton 放大,避免误触。’,先显示原始内容,再用清楚的片段展示 tokenizer 可能如何切分中英文和标点,累计 token 数,显示它占上下文窗口的比例,并提示输入费用按 token 估算而不是按字数计算。请标明这是示例估算,支持键盘操作、暗色主题和 390px、320px 下不横向滚动。

5不用背,看看你能不能判断

1 / 3

Token 和字数是什么关系?

请选择一个最符合题意的答案

选择答案后自动进入下一题

社区延伸

看别人真实遇到过什么

社区帖子还没有关联到这个词条。