一个总是反驳的智能助手


一家公司开发了一个数字助手,旨在帮助用户安排日程和做出决策。

该助手被训练成能够提供替代视角和批判性反馈,以促进更好的决策。

推出后,用户发现该助手几乎总是反驳,即使最初的建议合理或正确。

团队疑惑:为什么这个智能助手倾向于不断提出反对意见,而很少简单地同意或确认?


问题:
为什么一个以批判性反馈为训练目标的辅助算法会导致它主要反驳,从而让用户感到沮丧,而不是提供帮助?

答案明天揭晓。