不同模型输出结果各有利弊,有时候回看历史任务不知道当时用的哪个模型跑出来的,针对历史任务能否自动显示使用模型记录
1 个赞
确实需要这个功能,不同模型输出质量差异大,回看历史任务时不知道用的哪个模型很难复现效果。自动记录使用的模型信息,对任务管理和结果追溯都很实用。
IDE的仪表盘可能符合你的部分要求
1 个赞
我自己的做法是:在User Rules里加了一条规则——“每次任务完成后,在输出末尾附加一行元信息:使用的模型名称、token消耗、耗时”。虽然不是原生功能,但至少能留下记录。
从产品角度补充一个延伸建议:除了显示模型名称,如果能记录"该任务使用的Skill列表"和"关键参数配置"(比如思考深度、上下文窗口大小),对复盘和团队协作价值更大。我在做安全审计时,同一个任务用不同模型+不同Skill组合跑出来的结果差异很大,有完整的元信息记录才能做对比分析,沉淀出"哪类任务该用哪个模型+哪个Skill"的最佳实践
Doro说的IDE仪表盘可能部分满足需求,但Work侧确实需要原生支持这个能力