计算点数怎么消耗:不同模型比例不同
订阅套餐按「计算点数」计费,而不是直接按 Token。理解这套换算,才知道点数花在哪、怎么省。
为什么不直接按 Token
不同模型的成本天差地别。点数制用一个统一单位罩住所有模型:每个模型有自己的消耗比例——
- 标准模型(轻量档):每个 Token 扣的点少
- 高级模型(旗舰档):每个 Token 扣的点多
同样 200 万点,用轻量模型能用约一千多万 Token,用旗舰模型可能只有一两千万 Token 的几分之一。具体比例表以官方模型定价页实时数据为准。
什么在扣点
- 输入 Token:你发的内容 + 携带的上下文
- 输出 Token:AI 回复的内容
- 附加能力:生图按张数走独立额度,文档解析等增值处理也消耗点数
一轮对话的完整消耗 = 全部输入 + 全部输出,按所选模型的比例折算。这也解释了为什么长对话越聊越快见底——上下文在每轮重复计费,见上下文管理。
在哪看余额
- 每条消息下方显示该轮 Token 数
- 设置 → 账号页显示剩余计算点数与绘图额度
- 配额在每月购买日重置(如 15 号订阅,每月 15 号刷新)
五个省点实操
- 按任务选模型:查资料用标准模型,攻坚再上旗舰——最大的一笔节省
- 控制上下文:调低最大消息数、话题切换开新话题
- 指令一次说全:减少返工轮次
- 长材料先摘要再处理:别每轮都喂全文
- 盯住工作模式:Agent 多轮工具调用很费点,跑大任务前先估算
点数用尽的出路
三条:等重置、买扩充包(立即生效)、升级套餐。操作细节见配额用尽的出路。彻底绕开点数制的办法是转 BYOK 或本地模型(见接入方式总览)。