人机交互
人机交互让 Agent 在需要你的信息、判断、偏好、反馈或亲自参与时,主动把问题带回当前对话。它是一个受应用管理的 Tool 能力:模型可以提出问题,但 Captain Who 决定当前任务能否提问、如何保存回答,以及何时安全地继续工作。
它解决什么问题
Agent 并不应该猜测你没有提供的事实。例如:
- 需要你选定要修改的环境、分支或优先级;
- 两种设计方案都合理,需要你作取舍;
- 需要你登录某个网站、确认付款或完成只能由你进行的动作;
- 希望知道报告的受众、语言或输出格式。
在已有信息足够时,Agent 应自己推进,而不是把普通工作转交给你。提问也不会替代权限审批:即使你回答“可以”,文件修改、命令、联网或第三方操作仍遵循该任务的权限和审批规则。
阻塞与非阻塞的区别
需要用户参与
|
+-- 没有回答就不能继续
| -> 阻塞提问:任务暂停,等你回答
|
+-- 还有独立工作可完成
-> 非阻塞提问:任务继续,答案稍后送达阻塞提问适合“先问清楚再行动”。例如 Agent 不知道你希望修改哪个部署环境,它会暂停,避免在错误目标上继续工作。
非阻塞提问适合“边做边问”。例如 Agent 可以先了解项目结构、整理测试结果,同时询问你更偏好的报告格式。它只会继续与答案无关的工作,不会把“问题已显示”当作你的批准或完成证明。
你控制什么
默认情况下,普通对话的根 Agent 可以发起人机交互。你可以在“设置 → 个性化 → 人机交互”关闭“允许智能体向人类发起提问与协作”;关闭后不再产生新问题,但已出现的问题仍可以正常回答或忽略。
子 Agent 和无人值守的 Scheduled Automation 不会获得此能力。这样可以避免后台任务反复等待一个无人处理的问题。
对于每一批问题,你可以选择建议选项、输入自己的答案或跳过单题。异步问题还可以整批忽略。回答会保留在当前对话的历史中,以便你和 Agent 都能看到当时的上下文。
可见性与可靠性
非阻塞问题可以最小化,并从对话时间线的“交互”入口重新打开。阻塞问题则优先于普通输入,因为当前任务正在等待你。审批优先级更高:处理审批后可继续回答问题。
应用会把已接纳的问题和正式回答保存在本机,以应对重启或短暂连接故障;未提交的输入草稿只保存在当前窗口。提交后,系统会避免把同一批答案重复送入任务。对于无法确认是否已经执行的后续工作,Captain Who 不会自动重放可能产生副作用的操作。
当前系统不会仅因为 Agent 问了问题而单独发送系统原生通知。请通过当前 Conversation 的面板或时间线入口处理待答内容。
与其他能力如何配合
人机交互通常和其他能力配合使用:
| 能力 | 人机交互的作用 |
|---|---|
| Tool | 在调用文件、命令、搜索或浏览器 Tool 前澄清目标和意图 |
| Multi-Agent | 只有根 Agent 与你交互;子 Agent 将信息交回根 Agent |
| Scheduled Automation | 无人值守任务不能等待你的回答,应使用明确的任务条件和默认行为 |
| 系统通知 | 通知提示任务或审批状态;提问本身仍在对话内处理 |