跳到主要内容

tiktoken 速查表

tiktoken 是 OpenAI 开源的快速 BPE tokenizer,用于将文本编码为 LLM 可理解的 token ID。支持 GPT-4o、GPT-4、DeepSeek 等主流模型。准确计算 token 是控制成本和满足上下文限制的关键。

更新: 2026-07-20·8 条命令

快速开始

``bash pip install tiktoken python -c " import tiktoken enc = tiktoken.get_encoding('cl100k_base') tokens = enc.encode('你好世界') print(f'Token 数: {len(tokens)}') print(f'ID: {tokens}') print(f'解码: {enc.decode(tokens)}') " ``

启动模式(8)

命令难度
pip install tiktoken
安装 tiktoken
基础
tiktoken encode
将文本编码为 token ID
基础
tiktoken decode
将 token ID 解码为文本
基础
tiktoken count
计算文本的 token 数量
基础
tiktoken encoding for model
获取指定模型使用的编码器
基础
tiktoken batch count
批量计算多段文本的 token 数
中级
tiktoken cost estimate
估算聊天消息的 token 数和费用
中级
tiktoken special tokens
包含特殊 token 的编码
高级

常见问题

本速查表数据整理自各工具官方文档。最后更新: 2026-07-20。