如何合理使用 token:以 Kimi 为例
---
01. 日常问答、改写、翻译、总结全部交给 K2.6,它在会入口免费,把付费的 K3 严格留给需要交付成品的重任务。
02. K3 集群一次能跑几千次工具调用,是额度吞金兽,只有海量搜索、批量处理、超长文写作才值得动用。
03. K2.6 的免费仅限网页和 App 会入口,把它放进 Kimi Work 当 Agent 跑,照样从会员额度池里扣钱。
04. 图片、视频、音频生成插件都要走 K3 计费,先把提示词打磨到位再点生成,反复返工就是最贵的浪费。
05. 思考强度就是模型内心独白的预算,档位越高 Token 越多,请把默认档锁在“标准”,不够用再临时升级。
06. 先用标准档低成本试错,答得不好只损失几分钱;一上来就开极致档,答非所问时浪费的是几十倍成本。
07. 进阶和极致档不但更贵还明显更慢,复杂任务可能跑几个小时,只有质量压倒成本时才值得开这两档。
08. 模型每轮都要重读全部历史对,对越长每轮越贵,养成一事一窗的习惯,做完一件立刻开新窗口。
09. 长对做到一半主动让 Kimi 生成几百字的交接摘要,带着摘要开新窗,比无限续聊省一大截 Token。
10. 删除对里的历史消息并不能释放上下文,这是官方明确的误区,想减负只有开新会这一条路。
11. 超大文件先拆小再分次发送,第一轮就触顶等于白烧一次大钱,长文档先出目录只送相关章节深聊。
12. 长文输出让 Kimi 先给大纲、你确认后再分节写,避免一次生成几千字废稿,也方便中途随时纠偏。
13. 把周报、纪要、术等高频流程做成自定义技能,一次写好永久复用,不用每轮重新解释要求。
14. 调试好的提示词存进常用语一键调用,这是最被低估的功能,省打字时间更省反复试错的 Token。
15. 背景资料、写作风格、角色设定放进项目和记忆,新对自动带背景,别再每轮粘贴同样的长篇背景。
16. 每天重复做的事交给定时任务,一次配置自动运行,比每天手动开一段长对描述同样需求省得多。
17. 所有会员功能共享一个额度池、按月刷新不结转,记住月初别挥霍、月末别浪费,重任务要提前排预算。
18. 心里要有杆秤:一次深度研究约百分之五到十额度,一份简单 PPT 约百分之一二,K3 任务比 K2.6 贵得多。
19. 定期在设置订阅页看余额、刷新时间和使用明细,发现异常消耗立刻复盘是哪类任务偷偷吃掉了额度。
20. 省
 
 
Back to Top