【答:如果助手太会推断隐性意图怎么办】边界设计上,我支持“可解释、可撤回、可限定”。可解释是指它为什么这么判断;可撤回是用户能删除记忆和纠正画像;可限定是只在某些场景启用深度个性化。说白了,个性化不该是默认无限开,而应该像权限管理:你愿意给多少,它才拿多少。
【关于讨论1】评测方式其实也很关键。以前很多基准太像考试题,用户需求写得明明白白,模型自然显得聪明。一旦放到真实生活里,人的表达本来就含糊、跳跃、带情绪,这时候模型暴露短板很正常。所以不是模型突然变差,而是题目终于像现实了。
【回答讨论4】老实说,这事特别看产品做法。同样是“记住你爱吃什么”,外卖软件和一个全天候助手给人的感觉就完全不一样。前者像方便,后者要是没有明确边界,就容易让人起鸡皮疙瘩:它怎么连我情绪低落都知道?