人机交互

人机交互让 Agent 在需要你的信息、判断、偏好、反馈或亲自参与时,主动把问题带回当前对话。它是一个受应用管理的 Tool 能力:模型可以提出问题,但 Captain Who 决定当前任务能否提问、如何保存回答,以及何时安全地继续工作。

它解决什么问题

Agent 并不应该猜测你没有提供的事实。例如:

  • 需要你选定要修改的环境、分支或优先级;
  • 两种设计方案都合理,需要你作取舍;
  • 需要你登录某个网站、确认付款或完成只能由你进行的动作;
  • 希望知道报告的受众、语言或输出格式。

在已有信息足够时,Agent 应自己推进,而不是把普通工作转交给你。提问也不会替代权限审批:即使你回答“可以”,文件修改、命令、联网或第三方操作仍遵循该任务的权限和审批规则。

阻塞与非阻塞的区别

text
需要用户参与
  |
  +-- 没有回答就不能继续
  |     -> 阻塞提问:任务暂停,等你回答
  |
  +-- 还有独立工作可完成
        -> 非阻塞提问:任务继续,答案稍后送达

阻塞提问适合“先问清楚再行动”。例如 Agent 不知道你希望修改哪个部署环境,它会暂停,避免在错误目标上继续工作。

非阻塞提问适合“边做边问”。例如 Agent 可以先了解项目结构、整理测试结果,同时询问你更偏好的报告格式。它只会继续与答案无关的工作,不会把“问题已显示”当作你的批准或完成证明。

你控制什么

默认情况下,普通对话的根 Agent 可以发起人机交互。你可以在“设置 → 个性化 → 人机交互”关闭“允许智能体向人类发起提问与协作”;关闭后不再产生新问题,但已出现的问题仍可以正常回答或忽略。

子 Agent 和无人值守的 Scheduled Automation 不会获得此能力。这样可以避免后台任务反复等待一个无人处理的问题。

对于每一批问题,你可以选择建议选项、输入自己的答案或跳过单题。异步问题还可以整批忽略。回答会保留在当前对话的历史中,以便你和 Agent 都能看到当时的上下文。

可见性与可靠性

非阻塞问题可以最小化,并从对话时间线的“交互”入口重新打开。阻塞问题则优先于普通输入,因为当前任务正在等待你。审批优先级更高:处理审批后可继续回答问题。

应用会把已接纳的问题和正式回答保存在本机,以应对重启或短暂连接故障;未提交的输入草稿只保存在当前窗口。提交后,系统会避免把同一批答案重复送入任务。对于无法确认是否已经执行的后续工作,Captain Who 不会自动重放可能产生副作用的操作。

当前系统不会仅因为 Agent 问了问题而单独发送系统原生通知。请通过当前 Conversation 的面板或时间线入口处理待答内容。

与其他能力如何配合

人机交互通常和其他能力配合使用:

能力人机交互的作用
Tool在调用文件、命令、搜索或浏览器 Tool 前澄清目标和意图
Multi-Agent只有根 Agent 与你交互;子 Agent 将信息交回根 Agent
Scheduled Automation无人值守任务不能等待你的回答,应使用明确的任务条件和默认行为
系统通知通知提示任务或审批状态;提问本身仍在对话内处理

要实际处理一个问题,请阅读回答智能体的问题。若想了解回答会如何影响历史与上下文,继续阅读上下文与历史。

源文档核验 · 2026-09-14官网导入 · 2026-09-23来源版本 · 1278cf1