最近在折腾Qwen3.6-27B,24G 显存基本就能开始玩,32G/48G 会舒服很多
真正有意思的是另一件事:强模型负责“想”suchasK3大爷,27B 这种本地模型负责“干”
大概就是:
用户提出一个复杂任务
↓
云端 / 超强模型
↓
理解需求 + 制定方案 + 拆解任务
↓
Harness
↓
任务分配 / 状态管理 / 工具调用
↓
本地 27B / 小模型
↓
代码执行 / 文件处理 / RAG / 工具操作
↓
执行结果
↓
Harness 汇总结果
↓
必要时反馈给强模型重新决策
这样一来,27B 不需要承担我要怎么解决这个问题的全部思考压力
它只需要拿到一个足够明确的 Task,然后把它执行好
so27B 的意义可能是便宜、本地、可控的模型负责执行
甚至脑暴:一台强模型服务器 + 一堆本地 27B/小模型执行节点
就可以形成一个自己的 Agent 工厂,执行涉及的隐私还可以不出域,满足boss和信安的欲望
