Qwen3.8-Max-Preview初步测试

  • 接入渠道:千问云Token Plan
  • 测试环境:TRAE IDE+OpenCode
  • 测试参数:
    • 上下文窗口:1M
    • 推理强度:xhigh
  • 综合评分:7/10分

按照Qwen系列对于Preview的往期表现来看,预览版平均为正式版80%~90%强度,相比于上一代Qwen3.7-Max而言,以下能力有显著提升。

  1. 任务拆解能力
  2. Agent调用能力
  3. UI/UX设计能力
  4. 需求理解能力

实测项目:

  • Web项目UI/UX设计
  • 中小型项目bug检索修复
  • 复杂逻辑题
  • 长文本prompt测试任务拆解

综合评价:
Qwen3.8-Max-Preview有一定的强度,但对于官方所说的仅次于Fable系列这一说法目前Preview版本仍有一定差距,具体还是要看正式版Max强度和是否对小参数量化版本进行额外开源(这一项应该是很多人期待的,毕竟量化的Qwen模型用在ComfyUI的CLIP上目前并没有更好的替代)

1M上下文日常够用