深度研究功能平均要等待两分钟,但缩短推理会明显降低质量。你会怎样设计等待体验和延迟预算?
考察说明
考查长耗时 AI 任务的产品取舍与交互设计。
回答思路
- 先按任务价值判断用户是否愿意等待两分钟,并区分即时问答与可异步完成的深度任务,不能用同一延迟目标覆盖全部场景。
- 将总耗时拆成检索、工具、模型和重试,给每个步骤设预算并减少无效循环,而不是仅靠缩短最终输出牺牲质量。
- 运行中展示真实阶段、已完成内容和可取消状态,但不能用虚假的精确进度条掩盖系统实际上无法估算剩余时间。
- 允许用户离开页面并在完成后收到通知,保存任务状态且避免重复提交,失败后说明可恢复步骤而非从头开始。
- 可以先返回有证据的阶段性结果,再补充完整报告,但必须清楚标记完成度,避免用户把半成品当作最终结论。
- 通过任务完成率、等待退出、质量采纳和成功任务成本共同设定预算,不能只优化平均延迟而忽略高分位失败。