面向人机交互设计 Harness:构建以产物为中心的 Agent Loop

核心结论(一句话)

当人会直接选择、批注和修改工作产物时,Harness 应让产物的版本、语义对象、操作回执和验证证据成为协作状态;对话保留表达目标与解释判断的职责,而不再独占工作现场。

分类提炼

知识节点(8 个独立概念)

从对话入口到共同工作现场

代码任务可从仓库、diff、构建和测试重建状态,因此对话中心模型仍能工作。PPT、表格、图表、运行中网页和模拟器不同:人可能在两轮对话之间直接改变对象,那个改变本身就是意图和状态。下一轮 Agent 必须读取当前产物,不能只复述历史聊天。

Browser Agent、Cursor/Qoder 的页面选区和 Canvas 说明了同一个方向:用户无需把“这里”的视觉上下文重新翻译成长提示词,选中的对象、周边结构、批注和直接修改可成为下一轮输入。Canvas 的价值因此不在预览,而在让产物中的结构化节点成为解释、修复和追问的入口。

Harness 的四项职责

  1. 意图连续性:记录初始目标外的选择、批注、拒绝和接受理由,避免把后续协作误判为最初提示词的机械延续。
  2. 确定版本:所有读写和验证绑定明确版本、语义对象和结构地址,避免基于过期截图、坐标或内容执行。
  3. 运行时自治:浏览器、仓库与构建系统、文档和模拟器各自提供领域操作及验证;Harness 不替代它们。
  4. 可审查证据:记录实际变更、验证结果和无法确认的限制,禁止用“已完成”替代交付证据。

可行的最小模型不是一套万能画布,而是版本化的产物对象:文档可转为带语义地址的数据快照,运行产物可经受约束构建和隔离预览;共同层只管理意图、版本、操作、回执和证据。

采用检查表

证据边界

关联图谱

上游(基于 / 来自)

下游(应用于 / 验证于)

同级(横向 / 并列)

相关链接