为什么不能把 Emoji 当作单个 Token 来要求大模型输出?

在不少 Prompt Engineering 教程中,经常会看到类似的技巧:
- 「让模型只输出一个 Emoji。」
- 「用 Emoji 代替 Yes/No,可以减少 Token。」
- 「要求模型输出单个 Token,提高推理效率。」
这些说法听起来很合理,但实际上建立在一个错误前提之上:
认为一个 Emoji 等于一个 Token。
事实上,Token 是 Tokenizer 的产物,而 Emoji 是 Unicode 的产物,它们属于完全不同的层次。
理解这一点,需要先理清 Unicode、UTF、Emoji、Grapheme Cluster 与 Tokenizer 的关系。








