这确实挺让人困惑的~其实大模型扣除积分(或者说 Token 消耗),不仅仅是看你当前发的这一句话,而是由本轮输入 + 模型的输出 + 历史上下文三部分决定的。
在第一张图里,虽然你只说了一句“我哪说了e”,但为了理解来龙去脉,系统会把你们之前的聊天记录(甚至之前读取过的文件)作为“隐形输入”一起发给模型。如果这个对话已经聊了挺长一段时间,积累的上下文很大,那这一句的消耗就会比较高。
而在第二张图里,虽然 Agent 帮你执行了很多搜索和验证操作,但如果当时的对话历史还不是很长,总的上下文体量比第一张图小,最终扣除的积分反而会更少。
小建议:如果一个对话聊得很长了,觉得消耗有些快,可以随时新开一个对话窗口。这样能清空之前的历史上下文,不仅能省积分,还能让 AI 的注意力更集中哦~
如果只是和AI对话的话,你可以尝试自己接入API key

