把 AI 交付的代码想成装修:只说“把这里改好”不够,最好先写清完工标准。Claude 官方指南建议,在 Claude Code——可检查代码库、修改文件并执行命令的 Agent 式编程工具——里,把完整任务和验收条件一次讲明,例如“所有接口迁移、旧客户端删除、测试全部通过”。这样做尤其适合 Opus 5.5 的长程运行:模型能连续规划和处理多步任务,官方称早期测试者曾让它在很少监督下运行数小时。
指南也提醒,长任务不等于放手不管。用户可以在运行途中直接补充要求,无须重启;还应在 CLAUDE.md 中写清何时继续、何时必须停下询问,例如删除数据、强制推送或修改仓库外内容之前。完成后则要看测试和文件等可检查结果,不能只听模型说“做完了”。此外,Opus 5.5 每次回复前都会自行决定思考量,官方测试称删掉“仔细思考”等提示后,回复启动更快,且未见明显质量下降;这些表现目前仍主要来自厂商自述。