面向人机交互设计 Harness:构建以产物为中心的 Agent Loop
- 原文:https://mp.weixin.qq.com/s/FATmcD2PAZuJlNl6ReMOAQ
- 作者:Phodal;发布时间:2026-08-23;获取时间:2026-08-24
核心结论(一句话)
当人会直接选择、批注和修改工作产物时,Harness 应让产物的版本、语义对象、操作回执和验证证据成为协作状态;对话保留表达目标与解释判断的职责,而不再独占工作现场。
分类提炼
- 场景:Coding Agent、Browser Agent、Canvas、Office / GUI 产物协作
- 类型:人机协作模型 / Harness 交互设计
- 标签:#主题/AI-Agent #主题/Harness #主题/人机交互 #主题/Agent-Loop #主题/AI-Coding
知识节点(8 个独立概念)
- 产物中心:可持续演化的产物及其状态,是人和 Agent 共享的工作现场。
- 对话盲区:用户的直接编辑、选择与批准不一定进入聊天记录,单靠对话无法复原任务状态。
- 语义选区:选中对象必须能定位到结构和业务语义,不能只传截图或像素坐标。
- 版本绑定:选择、修改、比较和验证都指向同一产物版本,才不会对过期状态写入。
- 领域运行时:网页、代码、文档、表格与模拟器应由各自运行时保留结构、操作和验证能力。
- 协作协议:Harness 统一意图、版本、操作、回执与证据,而不统一每种领域模型。
- 操作回执:一次 Agent 写入应可说明修改了什么、结果如何、下一轮从何处继续。
- 验证证据:交付需要保留产物变化、已验证结果和未确认限制,供人做最终判断。
从对话入口到共同工作现场
代码任务可从仓库、diff、构建和测试重建状态,因此对话中心模型仍能工作。PPT、表格、图表、运行中网页和模拟器不同:人可能在两轮对话之间直接改变对象,那个改变本身就是意图和状态。下一轮 Agent 必须读取当前产物,不能只复述历史聊天。
Browser Agent、Cursor/Qoder 的页面选区和 Canvas 说明了同一个方向:用户无需把“这里”的视觉上下文重新翻译成长提示词,选中的对象、周边结构、批注和直接修改可成为下一轮输入。Canvas 的价值因此不在预览,而在让产物中的结构化节点成为解释、修复和追问的入口。
Harness 的四项职责
- 意图连续性:记录初始目标外的选择、批注、拒绝和接受理由,避免把后续协作误判为最初提示词的机械延续。
- 确定版本:所有读写和验证绑定明确版本、语义对象和结构地址,避免基于过期截图、坐标或内容执行。
- 运行时自治:浏览器、仓库与构建系统、文档和模拟器各自提供领域操作及验证;Harness 不替代它们。
- 可审查证据:记录实际变更、验证结果和无法确认的限制,禁止用“已完成”替代交付证据。
可行的最小模型不是一套万能画布,而是版本化的产物对象:文档可转为带语义地址的数据快照,运行产物可经受约束构建和隔离预览;共同层只管理意图、版本、操作、回执和证据。
采用检查表
- 人工选择或批注是否携带稳定对象标识和版本,而非仅像素位置?
- Agent 修改后是否能显示结构化 diff、预览或领域验证结果?
- 人工直接编辑后,下一轮是否重新读取当前产物而非只依赖聊天历史?
- 是否明确记录已验证内容与尚未验证内容?
- 是否把领域解释和执行留在相应运行时,而非让通用 Harness 猜测?
证据边界
- 本文是 Phodal 对 Better Harness 方向、Codex Office、Cursor/Qoder Canvas 与 Browser Agent 的观点文章,不是各产品的功能或性能评测。
- 原文所述产品实现、API / DSL 能力与截图示例未在本次编译中独立复现;“应当”类结论应作为架构假设,以真实协作任务验证。
- 产物中心不排斥对话,对话仍承担目标、约束和解释;变化在于它不再是唯一状态来源。
关联图谱
上游(基于 / 来自)
- [[01-ai-agents/phodal-Better-Harness-任务级证据评估]]:本文将任务级证据扩展到人与 Agent 共同维护的产物、版本与交互状态。
- [[01-ai-agents/phodal-Harness-Inspector-Agent交付可观察可检查可追溯]]:Intent、Process、Output 的证据链,为产物操作和版本回执提供审查框架。
下游(应用于 / 验证于)
- [[01-ai-agents/Harness工程AgentLoop]]:可将 Agent Loop 的状态、工具和失败处理扩展为面向不同产物的观察、操作、验证闭环。
- [[01-ai-agents/Loop-Engineering-验证才是瓶颈]]:产物变更只有连到领域验证器和人类判断,才构成可靠闭环。
同级(横向 / 并列)
- [[01-ai-agents/WorkBuddy-Harness工程复盘-从模型到可用Agent]]:后者讨论产品化 Harness 的上下文、记忆和反馈分层;本文补充人机交互与产物状态层。
相关链接