Qwen Code 0.16 重磅更新:支持 /goal 命令

简介: Qwen Code 0.16.0 推出 `/goal` 模式:用户只需声明目标(如“迁移到 Vitest”),AI 自主执行、测试、验证。其创新在于引入独立 judge model 进行客观验收,拒绝盲目执行,主动识别不可行任务并说明原因,兼顾自动化与可控性——解放双手,不交出判断权。(239字)

上周三下午三点,我盯着屏幕上一个卡了四小时的 CI 流水线,手里那杯咖啡已经凉得像西伯利亚的冬天。突然想到:如果有个助手能自己发现问题、自己修复、自己跑完测试,那我是不是就能去睡个整觉了?

巧了,这周 Qwen Code 0.16.0 刚好把 /goal 推上了舞台。而更巧的是,隔壁 Codex 也刚上线了类似功能。今天咱们不聊参数对比表,就聊聊:当代码助手开始"自主驾驶",我们程序员到底是解放了,还是失业了?

/goal 到底是啥?

简单说,以前你用 AI 写代码,像带个实习生:每步都要确认,"这个文件改吗?""那个命令跑吗?"。现在 /goal 让你直接说:"把项目从 Jest 迁移到 Vitest",然后——去喝咖啡。

但等等,Codex 不也能这样吗?

关键差异在这里:Qwen Code 的 /goal 请了个"第三方裁判"(judge model)。执行模型负责干活,裁判模型负责验收。就像你装修房子,施工队和监理不能是同一个人,对吧?

# 传统模式(自我判断)
Agent: "我觉得改完了" → 其实漏了三个测试文件 😅

# Qwen 模式(独立裁判)
Executor: "这轮改完了"
Judge: "等等,vitest.config.ts 还没创建,继续"

image.png

这个设计让我想起康德的"批判哲学":理性需要自我批判,但更需要外部审视。代码执行也是同理——让同一个模型既当运动员又当裁判,难免会有"我觉得我行了"的幻觉。

上个月我让某个助手"优化项目性能",结果它把 console.log 全删了,包括生产环境的关键埋点。为什么?因为它觉得"任务完成了"。

Qwen 的 judge model 有个很人性的设计:遇到不可能的目标会主动放弃。比如你说"用纯前端实现比特币挖矿",它不会硬着头皮跑三小时烧你 token,而是直接告诉你:"兄弟,这事儿在浏览器里真干不了"。

这点我特别认同。很多工具为了"显得能干",硬着头皮执行不可能任务,最后留下一堆半成品的代码垃圾。承认"这个我做不到",反而是更高级的智能。

和 Codex 的 /goal:表面相似,内核不同

维度 Codex /goal Qwen Code /goal
完成判断 执行模型自我评估 独立 judge model 验收
失败处理 通常继续尝试或报错 主动放弃 + 原因说明
集成方式 主要面向交互场景 支持 CI/CD 流式输出
风险控制 依赖用户配置 Auto Approval + 风险分类

举个实际场景:你要把 200 个测试文件从 Jest 迁移到 Vitest。

  • Codex 模式:跑着跑着遇到一个特殊语法不支持,可能卡住或乱改,需要你人工介入。
  • Qwen 模式:judge 发现"这个文件依赖了 Jest 特有 API,当前上下文无法处理",直接跳过并记录,最后给你一份"已完成 197 个,3 个需人工处理"的清单。

哪种更让你放心?反正我选后者——毕竟凌晨三点被叫醒改 bug 的体验,一次就够了。

自主与控制的永恒张力

写到这里,突然想起福柯在《规训与惩罚》里说的:权力不是压制,而是生产。AI 编程工具的发展,本质上也是"控制权"的重新分配。

  • 过去:程序员 100% 控制,每行代码亲手写
  • 现在:程序员定义目标,AI 执行细节
  • 未来?:程序员定义"什么是好代码",AI 自主迭代优化

/goal 的 judge model 设计,其实是在"完全放权"和"完全控制"之间找了个平衡点。就像教孩子骑车:一开始扶着后座,后来悄悄松手,但还在旁边看着。

"Man is condemned to be free." — Sartre

我们既渴望解放双手,又害怕失去控制。这种矛盾,可能才是技术演进最底层的驱动力。

结语

回到开头那个凌晨三点的问题:如果 AI 能自己跑完全程,我们还要做什么?

我的答案是:定义什么是"完成"

/goal 的 judge model 之所以重要,不是因为它能判断代码对不对,而是因为它把"验收标准"这个最核心的权力,交还给了人类。你可以说"测试通过就算完成",也可以说"还要通过代码审查",甚至可以自定义一套复杂的验收逻辑。

技术越智能,人的判断力越珍贵。就像相机自动对焦再厉害,构图和光影的审美,永远在摄影师眼里。

所以下次当你输入 /goal 时,不妨多想一秒:我真正想要的"完成",到底是什么样子?

毕竟,工具可以跑完全程,但方向,永远在你手里。🚀


相关文章
|
6月前
|
Prometheus 监控 网络协议
Go + gRPC 高性能调优实战指南
本文详解7个gRPC性能优化技巧:连接复用、KeepAlive调优、智能压缩、Protobuf对象池、并发流控制、字段编号优化及监控闭环。实测QPS从3k提升至15k+,延迟降低60%,内存分配减半,助你将gRPC从“限速60”飙到“时速120”。
473 3
|
JSON 前端开发 JavaScript
微前端项目难点解决(二)
微前端项目难点解决
1509 0
|
2月前
|
人工智能 JSON 运维
阿里云百炼 + Qwen3.7 实战:手把手构建一个支持工具调用的 AI Agent
本文记录使用阿里云百炼平台+Qwen3.7-Max构建企业级AI运维助手的全过程:依托其原生Function Calling、128K上下文与多工具并行调用能力,实现稳定、合规、低成本的Agent落地,含完整代码、踩坑解析与成本实测。
|
7月前
|
SQL 人工智能 安全
手把手教你调出“懂你”的AI:大模型微调实战与资源管理
本文深入浅出讲解大模型微调核心知识:用生活化比喻解析学习率、训练轮数、批量大小、截断长度和LoRA秩五大关键参数;提供适配不同显存的实操配置表;分享Liger Kernel、DeepSpeed等省显存技巧;并强调定量、定性与效率三维评估。零基础也能快速上手定制专属AI。
816 11
手把手教你调出“懂你”的AI:大模型微调实战与资源管理
|
5月前
|
人工智能 Linux 调度
SDK级嵌入还是RPC调用?OpenClaw两种集成模式的性能对比与选型指南
OpenClaw集成选型指南:SDK嵌入模式(进程内、低延迟、易调试、高权限控制)适合单机高QPS场景;RPC模式(服务解耦、跨节点调度、强隔离)适配多设备与物理世界交互。性能差达量级(SDK延时<2ms vs RPC约15ms),支持混用,文末附简易决策树助你避坑。
|
4月前
|
人工智能 运维 数据可视化
Dify 中开发 AI 智能体
在Dify中,通过可视化画布编排大模型、知识库与工具,快速构建AI智能体。涵盖模型接入、Agent/工作流选型、提示词工程、RAG集成、工具调用、调试优化及API/MCP发布,支持私有化部署与持续迭代。#AI智能体 #AI应用
|
5月前
|
安全 Linux API
🦞OpenClaw 保姆级图文攻略:阿里云/本地部署+百炼免费大模型API配置+Skill接入+避坑指南
对于零基础新手而言,2026年上手OpenClaw(Clawdbot)的核心关键,一是完成阿里云、MacOS、Linux、Windows11多平台的本地部署与阿里云百炼免费大模型API配置,二是搭建一套逻辑清晰的Skills技能体系。真正决定OpenClaw使用体验的,从来不是模型参数,而是能否安全安装技能、稳定实现联网、将工具接入真实工作流。本文将从多平台部署流程、API配置、核心技能安装、技能筛选、避坑要点等方面,给出保姆级实操指南,解决新手从部署到使用的全流程问题,同时附上常见问题解答,让零基础用户也能快速玩转OpenClaw。
1772 2
|
Oracle 关系型数据库
oracle的start with connect by prior如何使用 整理
oracle的start with connect by prior如何使用 整理
1290 4
|
jenkins 持续交付 开发工具
通过jenkins构建一个多分支的Pipeline项目
通过jenkins构建一个多分支的Pipeline项目