EXPERIMENT II · AGENT UX
看见 Agent
用户需要看到多少中间状态,才会信任一个正在执行的 Agent?
- Q提出可证伪的问题当前阶段
- R做最小运行路径未开始
- E连接真实验证未开始
- P公开证据与限制未开始
为什么值得做
只给结果,人无法判断 Agent 是否跑偏;把一切都摊开,人又读不过来。终端和界面该呈现什么,决定了人能否及时介入。
假设
HYPOTHESIS按事件投影呈现“正在做什么、调用了什么、依据是什么”的工具卡片,比只给结果或完整日志更早发现错误。
最小装置
MINIMAL SETUP- 01同一批任务准备三种呈现:只看结果 / 工具卡片 / 完整事件流
- 02在部分任务中埋入会导致错误结果的步骤
- 03记录参与者发现问题的时间点、打断次数和误判
什么会证明我错了
FALSIFIED IF工具卡片组的发现时间与误判率不优于另外两组。
将会公开
WILL PUBLISH三种界面原型、任务集、观察记录和访谈要点。
前期线索相关的已有工作,不是这个实验的结论
实验日志RUN LOG
还没有记录。实验开始后,每一次运行、失败和修正都会记在实验室里。
去实验室 ↗