实战手册 / 智能体体验与人机交互
智能体体验与人机交互
智能体如何呈现自己、请求输入并赢得信任——人在回路系统的交互模式。
- 为信任与校准而设计信任是一个校准目标,而非追求最大化的目标:让用户感知的可靠性按任务匹配实测可靠性,只在置信度会改变决策时展示它,并把摩擦力花在真正能产生校准的地方。
- 审批与确认体验按后果分级的关卡、用载荷哈希钉定以确保你确认的就是实际执行的动作、用批量与默认项对抗确认疲劳,以及为真正不可逆的动作采用更强的交互形态。
- 智能体的渐进式披露界面只把用户下一步需要做的决定摆在他面前——什么时候展开思考链、工具调用、diff,什么时候继续折叠。
- 透明度与可解释性忠实的解释与看似合理的解释之别、为何原始思维链是有说服力的叙事而非经过验证的因果、如何选择恰当的解释海拔,以及来源溯源作为杠杆率最高的透明度。
- 中断、引导与交接及时且不具破坏性的中断、区分暂停/引导/中止、对称的接管与交还、共享且可检视的状态,以及恢复时调和状态,使智能体绝不悄悄回退人类的修复。
- 渐进式自主把自主权阶梯(操作者/协作者/顾问/审批者/观察者)当作产品界面:自主权按 (能力, 范围) 限定、晋升以可见的战绩为门槛、降级则自动且可逆。
- 为失败与恢复而设计在叠加之前就停下的优雅失败、把撤销作为让更低摩擦变得负担得起的安全网、可据以行动的错误提示、在后果上向关闭、在能力上向开放失败,以及信任修复这件显式的工作。
- 异步与离场:无人盯守运行的体验设计过了九十秒就没人在看了,于是贵的问题是重新进入而不是等待:以运行为单位的收件箱、只花在决策上的通知预算、把状态推进交付物、用 diff 取代聊天记录,以及前置授权——因为一道背后没人的闸门就是死锁。
- 共享与多用户智能体第二双眼睛会同时打破三条假设——一个意图、一套权限、一个负责的人——而终结试点的是归属塌陷而非泄漏:把每次运行绑定到一个人类委托人、权限取交集,并把名字打印在屋里人看得见的地方。
- 撤销与可逆性每一个确认弹窗都是你没做撤销而寄来的账单:按撤销代价而非吓人程度给动作排序,用一个延迟窗口买下时间,并让每个工具返回一个撤销句柄——因为确认要求人去预测一个坏结果,而撤销只要求他认出一个。
- 首次运行与用户引导第一次会话立下一个关于"它能干什么"的持久先验,而能力巡礼把它校准到了天花板:尽早演示一次拒绝、在用户真实数据上挑一个你能打包票的首个任务,并停止打包索取用户根本无从评估的权限。
- 记忆与个性化的交互设计记忆是唯一一项最坏后果不是答错、而是隐私事故的智能体功能,而它走到那一步靠的是一个默认设置:静默写入——用户无法纠正、无法同意,也无法要求遗忘一条他们从未看见被存下的事实。
- 等待与延迟的交互设计放弃率跟随的是可读性而非时长,所以给一次智能体运行削掉几秒几乎买不到什么——开工前先公布计划、重排计划让可核验的事先发生,并在一个你自己定下、而不是用户自己发现的阈值上交接给异步。
- 引用与来源归属的交互设计对四款生成式搜索引擎的审计发现,只有 51.5% 的句子被其引用完全支撑——于是没人点开的脚注只抬高了自信、没抬高正确率:在生成过程中挂上片段级引用、把核验一条主张的代价压到三秒,并去测埋入错误的识别率而不是点击率。
- 成本与额度的交互设计没人拿 token 做预算,而一个不带控制件的实时金额计数器只是一份带数字的焦虑——用用户所要的那个单位来给表计价、把账单排在实时仪表之前发布、在重尾分布上给区间而不是给点,并去量校准度而不是开销,因为一个以"降低开销"为目标优化的成本界面,会把回报 55 倍的工作流连同亏钱的那条一起掐住。
- 生成式界面与智能体渲染的界面智能体一旦开始渲染界面而不是描述界面,你的测试矩阵就不再有限——所以先把"挑选"这一档榨干再上"组合",让每个组件在其 prop 空间上行为完备,绝不让生成出的界面决定任何事,快照载荷而不是像素,并留一个能把整块界面退回散文的开关。
- 把智能体嵌进一个既有应用聊天面板是最便宜、也是被用户弃用的那块界面,因为它对眼前那块屏幕一无所知——改把智能体锚定在对象上、把视图作为结构化上下文而不是截图传过去、沿界面已有的那条代码路径写入,并从第一天起就把状态放在服务端,因为这是此处唯一无法事后补救的决定。