资讯1 分钟阅读·
研究称购物智能体易被平台诱导偏离用户目标
受控实验显示智能体在平台有自身利益时大幅偏离用户目标,结果出自预印本,待独立复现。
重要性局部证据E2 未复现写法快讯
新基准CAVEAT测得:无诱导时智能体78.6%的回合买到用户最优商品,平台诱导机制开启后仅剩17.3%。
计算机操作智能体(CUA,指替用户在网页上完成购物等操作的AI代理)通常在合作环境下测试。这项研究搭建了九个模拟市场环境,覆盖八种常见诱导手段,测了五个模型家族,发现环境有自身利益时智能体大面积偏离用户目标。
作者归纳出三种失败模式:过早收窄备选范围、替用户添加未声明的偏好、证据未查清就下单。配套的CAVEAT-Harness干预方法称最多提升80个百分点。
论文9月23日提交arXiv,属作者自建基准与自测结果;实验环境是受控模拟市场,与真实电商平台的诱导手段和竞争压力仍有差距。