Concitech AI · 深度长文
2026/10/05 06:27
Opus 5.5 官方指南:任务终点、长流程与安全切换
Anthropic 的 Opus 5.5 官方指南讨论任务终点、长流程控制、结果核验与安全模型切换。官方测试提供部分体验判断;使用者承担验收标准与高风险操作边界的定义责任。

Anthropic 的《Getting the most out of Opus 5.5 in Claude and Claude Code》是一份产品使用指南。作者 Addy Osmani 讨论了任务交付、长流程控制、结果核验、Claude 应用与安全模型切换。中文推文介绍了这篇文章。
指南的中心是一份清楚的任务约定:任务内容、完成条件、求助条件。模型负责执行,人负责定义终点与检查结果。
原文包含 Anthropic 的产品测试与早期试用者反馈。这些体验判断缺少公开的独立对照数据。功能说明与性能判断是两类陈述。

提示词写清任务终点
官方建议一条请求包含完整任务、完成条件和求助条件。原文的支付接口示例包含三项验收:新客户端覆盖全部接口,旧客户端删除,测试套件通过。求助条件是一类原因不明的测试失败。
这类提示词像一张小型验收单:
任务:支付接口迁移至新客户端。
完成条件:全部接口使用新客户端;旧客户端删除;测试套件通过。
求助条件:测试失败原因缺少解释。
Anthropic 建议删除“仔细思考”“逐步思考”这类惯用语。原文称,Opus 5.5 的回复包含模型自定的思考预算。一项聊天产品测试比较了两类提示词。官方称,“仔细思考”的删除缩短回复启动时间,质量差异缺少清晰证据。这个观察缺少外部复现实验。
设计任务包含一个细节:具体排除项优于“不要普通设计”这类笼统要求。背景颜色、标题样式、按钮形态构成具体限制。约束的精度影响设计空间。
长任务的控制点
长任务带来新问题:模型给出进度摘要,任务本身缺少完成记录。官方建议把“继续执行条件”和“求助条件”写入项目的 CLAUDE.md。任务清单文件承载检查项。运行中的对话接纳新增需求,任务进度保留。
一条边界:删除数据、强制推送、仓库范围之外的变更属于高风险操作。原文保留人工确认和权限提示。长时间运行与无限授权是两回事。
大型审计拆成子任务。原文要求总控者核对各个子任务的证据。任务分派增加吞吐量;证据核对决定结果可信度。

验收证据
官方建议结果报告突出“需要用户处理的事项”。官方推荐代码任务的 diff 审查,问题清单包含文件位置、失败原因与复现方式。研究任务的报告列出缺失信息和核查范围。
这项建议改变了汇报的价值。一个“完成”标签缺少足够信息;测试输出、文件差异与未核实事项构成可检查的交付物。用户的判断是最后一道关口。
Claude 应用中的图表与截图是原文的重点。官方宣称 Opus 5.5 的图像理解能力提升,建议上传原图并提出具体问题。文档与表格任务的交付物是成品文件。图片识别能力与文件生成质量的判断属于 Anthropic 的产品说法。
安全标记触发模型切换
原文披露一项产品行为:Opus 5.5 的生物与网络安全防护包含内容标记机制。Claude 应用与 Claude Code 把大多数被标记的消息转交旧型号模型。旧型号模型接手任务。界面提示包含切换信息。标记范围覆盖对话历史、文件与搜索结果。
设置提供自动切换开关。关闭选项产生暂停卡片与人工选择入口。Claude Code 提供 /model、/config 与 /feedback 等操作入口。模型切换属于产品安全机制,任务的处理模型发生变化。结果核验包含界面型号提示检查。
原文介绍 Claude Code 的 /fast:同一模型的输出速度提升,额外用量与更高 Token 成本构成代价。文章把该功能称为研究预览;实际可用性取决于账户设置。

用户给出任务内容、完成条件和求助条件。模型提交结果与证据。安全机制改变处理模型,界面给出提示。这是指南交给使用者的一份任务约定。
