最准确的方式是调用腾讯云gettokencount接口预估token消耗,需设置action、version、prompt参数及bearer认证header,post至hunyuan.tencentcloudapi.com根路径,响应直接返回精确tokencount等字段。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要快速知道一段文本在腾讯混元模型中会消耗多少Token,比如写提示词前预估成本、调试长文档输入是否超限、或核对API返回的usage字段是否合理。
用GetTokenCount接口直接计算
这是最准确、最权威的方式,调用腾讯云官方Token计数接口,结果与实际推理消耗完全一致。
第一步:准备请求参数。确保包含 【Action=GetTokenCount】、【Version=2023-09-01】 和必填字段 【Prompt=你要测算的文本】,例如{"Prompt":"请帮我把这段Python代码改成异步版本"}。
第二步:设置HTTP Header。必须带上 【Authorization: Bearer YOUR_API_KEY】,这里的API Key必须是你在TokenHub控制台创建的有效密钥,过期或权限不足会导致401错误。
第三步:发送POST请求到域名 hunyuan.tencentcloudapi.com。不要拼错路径,接口地址是根路径 /,不是 /v20230901/ 或其他子路径。
响应体里直接返回TokenCount、CharacterCount和Tokens切分数组,数值精确到个位,无需额外换算。
在TokenHub控制台页面查看(仅限已提交的请求)
如果你已经用ChatCompletions等接口发过请求,可以在TokenHub控制台的「调用记录」里翻查历史用量。
打开TokenHub → 左侧菜单点「调用记录」→ 筛选时间范围和模型(如hy3-preview)→ 找到对应请求行 → 点右侧「详情」按钮。
在弹出面板里能看到 usage 字段,里面 prompt_tokens 和 completion_tokens 就是本次实际消耗的Token数。
注意:这里只显示已发生的调用,无法提前预估新文本——想测还没发出去的内容,必须走GetTokenCount接口。
用curl命令一行搞定(适合开发者快速验证)
方法一:基础版(替换YOUR_API_KEY和文本)
curl -X POST https://hunyuan.tencentcloudapi.com/ \ -H "Content-Type: application/json" \ -H "Authorization: Bearer YOUR_API_KEY" \ -d '{"Action":"GetTokenCount","Version":"2023-09-01","Prompt":"今天天气怎么样?"}'
方法二:带格式化输出(Linux/macOS可用)
curl -s -X POST https://hunyuan.tencentcloudapi.com/ \ -H "Content-Type: application/json" \ -H "Authorization: Bearer YOUR_API_KEY" \ -d '{"Action":"GetTokenCount","Version":"2023-09-01","Prompt":"分析以下SQL执行计划:SELECT * FROM users WHERE status=1 ORDER BY created_at DESC LIMIT 100"}' | jq '.Response.TokenCount'
jq命令会直接提取TokenCount数值,省得自己从JSON里找。没装jq的话,这一步跳过,看原始响应也行。










