联系我 ↗

EXPERIMENT II · AGENT UX

看见 Agent

用户需要看到多少中间状态,才会信任一个正在执行的 Agent?

待开始执行轨迹Session 日志人机协作
  1. Q提出可证伪的问题当前阶段
  2. R做最小运行路径未开始
  3. E连接真实验证未开始
  4. P公开证据与限制未开始

为什么值得做

只给结果,人无法判断 Agent 是否跑偏;把一切都摊开,人又读不过来。终端和界面该呈现什么,决定了人能否及时介入。

Q

假设

HYPOTHESIS

按事件投影呈现“正在做什么、调用了什么、依据是什么”的工具卡片,比只给结果或完整日志更早发现错误。

R

最小装置

MINIMAL SETUP
  1. 01同一批任务准备三种呈现:只看结果 / 工具卡片 / 完整事件流
  2. 02在部分任务中埋入会导致错误结果的步骤
  3. 03记录参与者发现问题的时间点、打断次数和误判
E

什么会证明我错了

FALSIFIED IF

工具卡片组的发现时间与误判率不优于另外两组。

P

将会公开

WILL PUBLISH

三种界面原型、任务集、观察记录和访谈要点。

前期线索相关的已有工作,不是这个实验的结论

实验日志RUN LOG

还没有记录。实验开始后,每一次运行、失败和修正都会记在实验室里。

去实验室 ↗