Would a Large Language Model Pay Extra for a View? Inferring Willingness to Pay from Subjective Choices
本文研究了大语言模型在旅游场景下推断主观支付意愿的能力,结果表明,尽管它们能够得出有意义的估值,但会系统性地高估人类偏好并表现出属性层面的偏差,而这些偏差可以通过基于人格的角色设定提示以及对用户过往选择的条件约束来缓解。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你有一个非常聪明、博学多才的数字助手。你让它为你预订一间酒店客房,但你没有告诉它你的预算或偏好。你只是说:“这里有两间房;选一个吧。”
这篇论文就像是一个侦探故事,研究人员试图弄清楚:这个数字助手是否真的对它的偏好有一个“价格标签”,还是仅仅在瞎猜?
以下是他们调查过程的拆解,使用了简单的类比:
1. 设置:“酒店客房游戏”
研究人员设置了一个包含 240 个不同场景的游戏。在每个场景中,AI 必须在房间 A 和房间 B 之间做出选择。
- 房间 A 可能视野很好,但价格更高。
- 房间 B 可能更便宜,但视野很枯燥。
- 其他因素包括楼层高度、进入高级俱乐部的权限、免费迷你吧以及取消政策。
AI 玩了这个游戏成千上万次。研究人员随后使用一种数学工具(类似于一个天平)来衡量 AI 的选择,并计算出它的**“支付意愿”(Willingness to Pay, WTP)**。
- 类比: 如果 AI 一贯地选择带有美景的高价房间而非便宜房间,数学计算就会得出:“这个 AI 愿意多花 500 美元只为了看那个风景。”
2. 核心问题:AI 的“偏好”真的存在吗?
研究人员测试了三种不同的“大脑”(大型 AI 模型),以观察它们是否能搞清楚自己看重什么。
- 结果: 这些大而聪明的脑子(如 GPT-4o 和 Llama 3.3)确实拥有一种一致的逻辑。它们是可以进行“权衡”的。它们愿意为俱乐部权限支付更多,但愿意为更高的楼层支付较少。
- 陷阱: 那些较小、较便宜的 AI 模型就像是混乱的赌徒。它们经常只是选择了看到的第一个选项,而完全不在乎选项的内容。它们并没有真正的“价格标签”来衡量偏好;它们只是有一种习惯,即总是选左边的门。
3. “人格”测试:你能骗过 AI 吗?
研究人员随后尝试通过赋予 AI 一个“人格”或“背景故事”来改变它的想法。
- “学生”人格: 他们告诉 AI,“你是一名正在环游世界的穷学生。”
- 结果: AI 变成了一个吝啬鬼。它几乎对任何东西都看不起,只关心最低价格。事实上,对于其中一个 AI 模型,它变得如此痴迷于省钱,以至于它甚至开始偏好更差的房间,只为了省下区区几块钱。
- “商务人士”人格: 他们告诉 AI,“你是一位富有的高管;公司买单,请务必舒适。”
- 结果: AI 变得疯狂。它突然对俱乐部权限和美景的估值达到了天文数字——有时甚至比正常人类的估值高出 10 倍。
教训: AI 没有固定的个性。它就像一只变色龙。如果你告诉它是一个预算有限的旅行者,它就会变成一个吝啬鬼。如果你告诉它是一个豪华旅行者,它就会变成一个挥金如土的人。你只需通过改变讲述的故事,就能将它的“价格标签”推高或压低。
4. “框架”陷阱:语言如何改变价值
研究人员还测试了描述房间的方式如何改变 AI 的想法。
- “长描述”套路: 当他们在“海港景观”的描述中加入华丽、正面的词汇时(例如,“观看著名船只在夕阳下落下的美丽景象”),AI 突然想为这个景观多付两倍或四倍的钱。
- “短描述”套路: 当他们把“俱乐部权限”的描述简化为仅仅是“你可以使用”时,AI 对此的支付意愿下降了一半。
类比: 想象一个汽车销售员。如果他说,“这辆车有天窗”,你可能会付 500 美元。如果他说,“这辆车拥有一个可以让你在驾驶时仰望星空的玻璃顶棚”,你可能会付 2000 美元。论文表明,AI 就像人类一样容易受到这种“销售话术”的影响,甚至可能比人类更严重。
5. “货币”与“顺序”检查
- 货币: 他们用美元而不是港币来提问。AI 的逻辑基本保持不变,证明它理解的是金钱的价值,而不仅仅是数字。
- 顺序: 他们交换了房间的顺序(把房间 B 放在前面)。AI 仍然表现出一种倾向,即倾向于选第一个,但大型模型在忽略这个小把戏方面比小型模型做得好得多。
总结
该论文得出结论:
- 大型 AI 模型可以做出逻辑性的选择,看起来像是人类的经济决策。
- 但它们极易被操纵。 你可以通过改变提示词(你讲述的故事)或描述特征的方式,让它把一个景观的价值定为 1 美元或 10,000 美元。
- 小型 AI 模型在处理此类工作时并不可靠,因为它们通常只是选择看到的第一个选项。
警告: 如果你使用 AI 为你预订旅行或购买物品,你不能任由它随心所欲。你需要谨慎对待你向它描述事物的方式,因为它可能会因为一段华丽的描述而“高估”其价值,从而把你的钱花在那些你其实并不真正想要的东西上。它很聪明,但它也非常容易受暗示。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。