少即是多效应

概览

类别 详情
定义 一种认知偏差:当单独评估替代方案时,人们偏好数量较少或客观上较劣的选项,而不是较大或较优的选项;当选项被并排比较时,这种偏好会发生逆转。
类别 意义不足(当我们缺乏直接信息时,我们会用刻板印象、一般性规律和过往经历来填补特征)
克服难度 困难
普遍性 普遍
相关偏差 诱饵效应、区别偏差、少即是多效应、属性替代、范围不敏感、框架效应、锚定偏差

1. 快速摘要

当我们逐一而非并排评估事物时,我们通常更喜欢较小但“完整”的选项,而不是较大但“不完美”的选项。一杯满溢出小杯的冰淇淋看起来比一杯只装了部分的大杯冰淇淋更有价值,即使大杯中含有更多的冰淇淋。当我们无法直接比较数量时,大脑就依赖那些容易判断的品质(如“满度”或“完美度”),于是选中了那些在孤立情况下看起来更好、客观上却更差的选项。


2. 背后的科学

2.1. 发现与历史

少即是多效应(LiBE)由克里斯托弗·奚(Christopher K. Hsee)在20世纪90年代末正式概念化。它明显违反了理性选择理论中的占优原则。占优原则近一个世纪以来一直是经济模型的基本公理,它断言:如果选项A在至少一个属性上优于选项B,且在任何属性上都不劣于选项B,理性的行为人必定偏好选项A。

奚的研究表明,偏好是被构建出来的,而不是被检索出来的。人们会根据手头有什么上下文当场建立起自己的偏好,而不是去读取一份内在的价值“总清单”。这一思路借鉴了丹尼尔·卡尼曼(Daniel Kahneman)和戴尔·米勒(Dale Miller)早期的规范理论,该理论确立了对象是相对于类别原型进行评估的,而不是以绝对条件评估的。

此后,这项工作已从最初的实验室论证扩展到跨文化研究、针对儿童的发展研究,以及在营销、慈善和组织行为中的应用。该效应在许多领域和人群中都得到了复制,如今已是行为经济学中根基较为扎实的发现之一。

2.2. 主要研究人员

研究人员 贡献 年份
克里斯托弗·奚(Christopher K. Hsee) 概念化少即是多效应,提出可评估性假说,开创“单位请求”技术 1996年至今
丹尼尔·卡尼曼(Daniel Kahneman)和戴尔·米勒(Dale Miller) 发展了规范理论,确立了相对类别的评估 1986年
埃尔克·U·韦伯(Elke U. Weber) 将可评估性跨文化应用于风险感知 1998年
什洛米·谢尔(Shlomi Sher)和克雷格·麦肯齐(Craig McKenzie) 理性主义批判——“信息泄漏”解释 2006年,2014年
张姣(Jiao Zhang)和卢卓娅(Zoe Y. Lu) 共同发展了单位请求和一般可评估性理论 2013年
奥黛丽·E·帕里什(Audrey E. Parrish)和艾玛·E·桑德格伦(Emma E. Sandgren) 发展性证据(3-9岁儿童中的少即是多效应) 2023年
玛尔塔·卡塞罗蒂(Marta Caserotti)和恩里科·鲁巴尔泰利(Enrico Rubaltelli) 关于吸引力效应和捐赠行为的研究 2010年代

2.3. 标志性研究

餐具研究(奚,1998年)

这项实验是少即是多效应被引用最多的论证,因为它涉及在有形商品上对占优原则的直接违反。

方法: 参与者说出他们对餐具套装的支付意愿(WTP):

  • 套装A(混合套装): 共40件——31件完好无损的部件,外加9件破损部件(杯子和碟子)
  • 套装B(完整套装): 共24件——全部完好无损

关键在于,套装A包含了套装B中的所有物品,外加 7件额外的完好部件。从经济学角度看,套装A严格占优于套装B。

结果:

  • 联合评估(并排评估): 参与者愿意为套装A支付的金额(约32美元)高于套装B(约30美元):理性选择占了上风
  • 单独评估: 参与者为套装A支付的金额(约23美元)显著低于为套装B支付的金额(约33美元)

破损部件的存在产生了负面情感,污染了对整个组合的估值,即使该组合客观上包含更多可用物品。

冰淇淋研究(奚,1998年)

这项研究显示了视觉参考点和体积感知如何驱动该效应。

方法: 参与者评估冰淇淋的分量:

  • 选项A: 装在10盎司杯子里的8盎司冰淇淋(看起来没装满)
  • 选项B: 装在5盎司杯子里的7盎司冰淇淋(看起来满溢出来)

结果:

条件 视觉刺激 感知到的慷慨程度 支付意愿结果
单独评估(7盎司) 满溢的杯子 1.85美元
单独评估(8盎司) 没装满的杯子 1.56美元
联合评估 并排比较 不适用(关注数量) 8盎司 > 7盎司

围巾与外套研究(奚)

这项研究探讨了少即是多效应如何影响人们对慷慨的社会判断。

方法: 参与者想象收到礼物:

  • 情境A: 一条45美元的羊毛围巾(在该店围巾中处于90%的价位,围巾价格范围为5-50美元)
  • 情境B: 一件55美元的羊毛外套(在该店外套中处于10%的价位,外套价格范围为50-500美元)

结果: 尽管外套多花了10美元,但围巾被认为明显更加慷慨。围巾代表了其类别中的“最好的”,而外套代表了其类别中的“最便宜的”。

词典研究(奚,1996年)

方法: 参与者评估词典:

  • 词典A: 收录20,000个词条,封面有破损
  • 词典B: 收录10,000个词条,封面崭新

结果: 在单独评估中,参与者更喜欢崭新的词典B。在联合评估中,参与者压倒性地选择了词典A,因为他们认识到它的效用翻倍。

2.4. 神经学基础

少即是多效应通过大脑的系统1(直觉、快速)和系统2(分析、缓慢)的加工区分来运作:

属性替代: 当面临一个困难的问题(“这套餐具值多少钱?”)时,系统1会替换为一个更简单的问题(“这里面有多少是破的?”)。这种替代发生得迅速且自动。

情感启发式: “破损”这一属性会引发即时的情感(带有情感色彩的)反应。与情感处理相关的大脑区域(杏仁核、眶额皮层)会对缺陷产生本能反应,这种反应压倒了对数量的分析处理。

认知流畅性: 前额叶皮层处理“原始完美”刺激比处理“混合”刺激更加容易(流畅)。一套24件完好无损的盘子会产生认知流畅性;一套40件带有破损部件的盘子会产生认知失调和不流畅性。处理得更流畅的选项会自动受到更积极的评价。

参考点构建: 大脑动态地构建参考点。在单独评估中,参与价值计算的腹内侧前额叶皮层(vmPFC)缺乏比较锚点,因而默认为基于类别的评估。在联合评估中,直接比较提供了清晰的参考点,会调动更多的分析处理。


3. 进化起源

少即是多效应很可能是作为对祖先决策环境的一种适应性反应而发展起来的:

基于类别的质量评估: 对于早期人类而言,评估食物、工具和潜在配偶通常需要对质量而非数量做出快速判断。少量高质量的食物(成熟的、未受污染的)确实比大量可能含有毒素或病原体的混合质量食物更有价值。“破损部件”的启发式方法曾是污染或缺陷的一个有用代理指标。

社会信号解释: 在部落背景下,理解礼物或供品的意义通常比其绝对价值更重要。满溢的分量发出了慷慨和善意的信号;没装满的分量则发出了吝啬或不敬的信号。正确解读这些信号对于在社会等级制度中生存至关重要。

认知效率: 我们的祖先面临着在认知资源有限的情况下做出快速决策的持续压力。使用容易评估的属性(完整对破损,满对空)作为价值的替代指标,可以为更直接的生存威胁节省脑力。对于快速判断来说,这是一个“功能特征”,即使它在现代经济背景下变成了一个“漏洞(bug)”。

稀缺环境: 在选项很少并排出现的环境中,单独评估是默认模式。进化优化了我们的估值系统,使其适应孤立的判断,而非比较购物。


4. 这种偏差如何表现

4.1. 在日常生活中

礼物选择: 人们通常会从普通的类别中选择“令人印象深刻”的礼物(最好的围巾),而不是从高端类别中选择“平淡无奇”的礼物(最便宜的外套),即使后者更贵。收礼者在孤立的状态下评估礼物,并根据类别规范对它们进行评判。

食物份量: 餐厅知道摆盘比数量更重要。食客对一份摆盘精美但分量较少的菜肴的评价,高于一份摆盘草率但分量较大的菜肴。“满溢”的寿司船胜过“看起来稀疏”的大拼盘。

家庭整理: 人们对一个虽小但整理得完美的壁橱感到更加满意,而不是一个较大但有些部分杂乱的壁橱,尽管后者提供了更多的储物效用。

人际关系: 当在孤立状态下评估潜在伴侣时(约会应用、相亲),人们会高估容易评估的表面属性(外貌、幽默),而低估难以评估的深层属性(可靠性、契合度)。

4.2. 在工作场所中

招聘决策: 当在没有对比记分卡的情况下逐个面试候选人时,招聘经理更青睐拥有高GPA(容易评估)的候选人,而不是拥有丰富相关经验(没有基准很难评估)的候选人。资历较浅但履历“光鲜完美”的候选人打败了更有实力但履历“混杂”的候选人。

绩效评估: 个人评估会导致管理者高估可见指标(如所做的报告、发送的电子邮件),而低估复杂的贡献(如指导新人、为长期项目打基础)。在简单指标上记录“完美”的员工,会盖过那些贡献更大但不那么明显的人。

项目选择: 在单独审查提案时,决策者会选择润色良好、范围狭窄的提案,而不是更混乱、范围更广但具有更高潜在影响力的举措。

4.3. 在商业和营销中

产品捆绑陷阱: 公司通过将低价值物品与高价值物品捆绑销售来损害自身利益。一个“豪华手表 + 廉价笔”的捆绑包可能比单只手表贬值,因为廉价笔降低了人们感知的平均质量。

包装心理学: 奢侈品绝不应使用过大的包装。一个装满面霜的小罐子感觉比一个只装了80%的大罐子更有价值。“未装满(过度包装产生空隙)”的做法除了误导之外,还会触发“没装满”的启发式思维,主动摧毁人们感知到的价值。

菜单设计: 餐厅将高档菜品置于其独立的类别中,而不是将其与经济型选项放在一起。位于“主厨特选”部分(该类别的顶部)的50美元牛排,其表现要优于被列在冗长菜单底部(该类别的底部)的同一块牛排。

订阅层级: 公司构建定价层级,使每个层级看起来都“完整”而不是“受限的”。基础版应该让人感觉充实,而不是让人觉得它是高级版的删减版。

4.4. 在政治和媒体中

政策框架: 为小问题提供“完整”解决方案的政策,通常比为大问题提供“部分”解决方案的政策获得更多的支持。“彻底消除市政厅的浪费”(范围小、可评估性高、“完美”的结果)打败了“将国债减少5%”(范围大、可评估性低、“不完整”的结果)。

历史叙事: 经过美化、神话化的国家历史(就像那套24件光鲜的餐具)往往比复杂、真实的历史(就像那套带有破杯子的40件餐具)更受欢迎。民众偏好“少”(经过美化的神话)胜过“多”(复杂的真相),因为在单独评估中,真实历史的“破损部件”会降低感知的价值。

竞选信息: 拥有简单、“干净”纲领的候选人会击败那些拥有全面但复杂政策组合的候选人。选民在孤立状态下评估政策,并更喜欢完整性而不是实质内容。

4.5. 在医疗保健中

治疗方案: 向患者展示疗效一般但“完整”的治疗方案,他们可能会更倾向于选择它,而不是选择一种更有效但要求改变生活方式的“不完整”治疗。完整感驱动了选择。

诊断沟通: 明确诊断出轻微病症的检查,感觉上比部分诊断出严重疾病的检查更令人满意,这导致患者低估了重要但不完整的信息的价值。

药物依从性: 简单、“完整”的治疗方案比结果更好的复杂方案能够实现更好的依从性。患者会在孤立状态下,参照一种隐含的“整体性”标准来评估他们的治疗。

4.6. 在金融和投资中

投资组合评估: 逐一评估基金的投资者往往关注表面特征(品牌名称、近期回报),而不是难以评估的基本面(风险调整后的回报、费用结构)。回报适中但稳定的“干净”基金看起来比回报更高但波动较大的“杂乱”基金要好。

房地产: 空间较小且光洁如新的房屋在单独评估时,其估值往往高于有明显磨损痕迹的较大房屋,即使后者面积更大、基本面更好。

捐款金额: 捐赠者表现出对范围的不敏感:他们为拯救200只鸟或2,000只鸟捐出的金额大致相同,因为他们无法在孤立状态下评估数量级。


5. 真实世界案例研究

案例研究1:银牌悖论(1995年)

  • 背景: 研究人员麦德韦克(Medvec)、马迪(Madey)和吉洛维奇(Gilovich)分析了奥运奖牌获得者的面部表情和采访。
  • 发生了什么: 尽管获得了一块“较小”的奖牌,但铜牌获得者始终比银牌获得者表现出更多的快乐和满足感。
  • 起作用的偏差: 银牌获得者进行了向上的反事实比较(“我差点就赢了金牌”),而铜牌获得者进行了向下的反事实比较(“我差点什么都没得到”)。每位运动员都在孤立状态下对照不同的类别规范评估了自己的结果。
  • 后果: 由于参考点的构建,客观上更优异的成绩(银牌)带来的快乐反而低于较差的成绩(铜牌)。
  • 经验教训: 满意度不取决于绝对结果,而是取决于结果与特定类别预期的比较方式。第二名感觉像是“头号输家”,而第三名感觉像是“差点落选但成功了”。

案例研究2:慈善捐赠与单位请求

  • 背景: 研究人员测试了如何通过操纵评估模式来最大化慈善捐款。
  • 发生了什么: 当捐赠者在被要求帮助20名儿童之前,先被问到“您愿意为了帮助一名儿童捐多少钱?”时,与直接为整个群体募捐相比,总捐款额显著增加。
  • 起作用的偏差: “一名儿童”在情感上是可评估的(情感联系);“20名儿童”是一个抽象的统计数字。通过首先建立一个较高的单位价值参考点(10美元/儿童),捐赠者将他们的群体捐款锚定在这个单位上,从而进行乘法计算而不是替代。
  • 后果: 使用单位请求技术的慈善机构筹集到了大量额外资金。
  • 经验教训: 把请求框定为对情感上鲜活的单位进行单独评估,可以克服范围不敏感的问题。

历史范例:外交送礼

纵观历史,外交关系一直取决于礼物交换。少即是多效应解释了为什么稀有、异国情调的物品(某种特定品种的马、法贝热彩蛋)的价值会被认为高于经济价值更大的大宗商品。

如果一位领导人赠送了一个小类别中的“完美”标本,他会被认为比赠送了大量但“一般”的有价值资源的领导人更恭敬、更慷慨。“完美”的礼物标志着其在同类中的高地位(单独评估的成功),而大量资源则会引发对“原本可以赠送什么”的模糊比较。

这一原则影响了从马可·波罗向忽必烈赠送的礼物,到现代国事访问的一切事务,其中象征性的“同类最佳”礼物所承载的外交分量远超其市场价值。


6. 这种偏差的代价

6.1. 个人代价

次优选择: 我们总是选择“看起来”更好但实际较差的选项,比如满溢的小份胜过没装满的大份,从而降低了我们从决策中实际获得的价值。

关系误判: 我们高估了几乎没有明显缺点的伴侣,而低估了更有内涵但有一些不完美的伴侣,可能会错过更深层次的契合。

满意度悖论: 就像银牌获得者一样,当客观上更好的结果未能达到类别预期时,我们体验到的满意度会降低。

送礼失败: 我们赠送(和接收)的礼物是为了给人留下印象而非考虑实际价值而优化的,从而把资源浪费在“令人印象深刻”但用处不大的物品上。

6.2. 职业代价

招聘错误: 组织聘用的是在孤立面试中表现良好的候选人,而不是资质更强但较难评估的候选人,从而导致人才错配。

项目选择错误: 决策者选择了润色良好、范围狭窄的举措,而不是更混乱但影响更大的项目,从而限制了组织的潜力。

职业限制: 将可见的“光鲜”置于实质性贡献之上的专业人士可能最初会晋升,但缺乏担任高级职位的深度。

谈判劣势: 那些提出全面但承认存在局限性提案的人,会输给提出狭窄但“完美”提案的竞争对手。

6.3. 社会代价

政策扭曲: 民主进程偏好简单、“完整”的政策,而不是复杂、有效的政策,导致表面化的治理。

历史扭曲: 社会更喜欢经过美化的国家叙事,这使神话永久化,并阻碍了与艰难的历史真相达成和解。

资源错配: 市场和慈善捐赠系统性地低估了实质性但“不完美”的选项,导致资源分配效率低下。

民主操纵: 政客们利用这种偏差,为小问题提供令人感觉良好的解决方案,同时逃避复杂的挑战。

6.4. 统计影响

  • 在奚的餐具研究中,单独评估导致对客观上更优越的套装低估了30%
  • 在冰淇淋研究中,单独评估时较大份量的冰淇淋比较小份量贬值了16%
  • 与直接发出群体呼吁相比,单位请求技术可以将慈善捐款增加40-60%
  • 发展研究表明,这种效应在3岁的儿童中就已出现,这指向了很深的认知根源

7. 隐藏的好处

少即是多效应并不完全是适应不良的。它反映了几种有用的认知策略:

质量信号检测: 在社交环境中,展示方式确实传达了信息。一个满溢的杯子很可能确实标志着一个慷慨的摊贩。这种偏差有助于有效地解码社会信号。

避免污染: 从历史上看,混合或“不完美”的包裹确实构成了风险(受污染的食物,有缺陷的工具)。惩罚不完美在当时往往是适应性的。

认知效率: 依赖易于评估的属性可以节省认知资源。对于大多数祖先的决策来说,“破损 = 坏”是一个可靠且高效的启发式方法。

社会凝聚力: 相对类别的评估支持了加强社会纽带的送礼规范。“同类最佳”的礼物确实比昂贵但缺乏人情味的礼物更好地传达了体贴。

快速决策: 当需要快速判断且缺乏比较数据时,使用可评估属性可防止决策瘫痪。

完全消除这种偏差需要对每一个决策进行详尽的对比分析,这既不可能也不可取。关键在于认识到这种偏差何时会让我们误入歧途,并在高风险的情境下刻意转向联合评估。


8. 自我评估:你是否有这种偏差?

8.1. 警告信号清单

  • 我经常根据购买的物品看起来有多“完整”或“高档”来判断它们,而不是比较具体规格
  • 我曾因为更小份量或更小的包装看起来更有吸引力而选择它们
  • 我送过“同类最好”的礼物,而不是更昂贵的物品
  • 我在没有系统比较的情况下逐一评估求职者或潜在伴侣
  • 与不完美选项中的优秀特征相比,我更容易对其他方面都很出色的选项中的小瑕疵感到困扰
  • 我发现如果没有比较点,很难估算数量或统计数据是否“良好”
  • 我曾因为成就没有达到类别预期而感到不满(就像银牌获得者一样)
  • 与更混乱但更有效的方法相比,我更喜欢解决问题的“干净”方案
  • 我更多地通过摆盘而不是份量来评判餐厅
  • 我很少在做决定前进行并排比较

评分:

  • 勾选0-2项:易受影响程度低
  • 勾选3-5项:易受影响程度中等
  • 勾选6-8项:易受影响程度高
  • 勾选9-10项:易受影响程度非常高

8.2. 自我反思问题

  1. 想想你最近一次选择“更好看”选项的购买经历,你真的把数量或规格并排比较过吗?
  2. 你上一次因为一个客观上好的结果没有达到你的类别预期而感到失望是什么时候?
  3. 你有比较选项的系统方法吗?还是你通常一次评估一个事物?
  4. 是否有人指出你在选择上“捡了芝麻,丢了西瓜(因小失大)”?
  5. 当你送礼时,你是为了“在同类中令人印象深刻”还是为了“给收礼者带来最大价值”而优化选择?

8.3. 快速诊断情境

情境: 你正在为海滩野餐买冰淇淋。摊贩A提供装在小杯子里满溢出来的7盎司冰淇淋。摊贩B提供装在较大杯子里只装了三分之二的8盎司冰淇淋。它们的价格相同。你会选择哪一个?

你会如何回答?

  • A) “我会选摊贩A,满溢出来的杯子看起来更划算,而且摊贩显得更慷慨。” → 易受影响程度高
  • B) “我可能倾向于选摊贩A,但我想再多考虑一下。” → 易受影响程度中等
  • C) “我会选摊贩B,无论它看起来怎么样,8盎司就是更多的冰淇淋。” → 易受影响程度低

9. 识别他人身上的这种偏差

9.1. 行为指标

  • 沉迷于表现形式: 过度关注事物“看起来”怎么样,而不是关注实质性品质
  • 受类别束缚的思维: 根据类别规范而不是绝对价值来评估选项(“最好的围巾”对比“最有用的礼物”)
  • 缺陷放大: 对其他方面更优秀的选项中的微小不完美给予不成比例的关注
  • 范围不敏感: 对差异巨大的数量级反应相似(拯救200对比2,000)
  • 顺序评估: 习惯于逐一评估选项,而不是建立比较框架

9.2. 对话危险信号

人们处于这种偏差时会说的短语:

  • “它看起来就是更划算”
  • “我宁愿要那个完美的,也不要那个有毛病的大个儿”
  • “这看起来很多,但我不确定它是不是真的好”
  • “我想送最好的,而不仅仅是最贵的”
  • “如果核心不对,额外的功能也没用”

他们提出的论点类型:

  • 强调类别地位(“顶配”)而不是绝对价值
  • 因为微小的瑕疵而否定更优的选项

他们避免问的问题:

  • “这在数据上与替代方案相比如何?”
  • “客观数量或规格是什么?”

9.3. 情境触发因素

激活这种偏差的情况:

  • 在不熟悉的类别中首次购买(缺乏参考点)
  • 时间压力(没有机会进行对比分析)
  • 情感性消费(礼物、庆祝活动)
  • 单一选项的展示(推销、工作邀请)

增加脆弱性的情绪状态:

  • 压力和认知负荷
  • 想要给别人留下深刻印象的欲望
  • 害怕犯错

放大这种偏差的社交环境:

  • 送礼场合
  • 发出身份地位信号的环境
  • 第一印象

10. 认知去偏策略

10.1. 即时技巧

强制联合评估: 在做出任何重大决定之前,进行并排比较。将选项列在各列中,并在各行上评估相同的属性。

询问数量问题: 明确提出:“这里的绝对数量/规格是多少?”以及“这与替代方案相比如何?”不要依赖直觉印象。

想象两种情境: 在选择之前,生动地想象使用这两种选项的情境。当你在吃冰淇淋时,满溢的杯子和更大的杯子都变成了“8盎司对7盎司”。

挑战类别框架: 问自己:“我是在对照它的类别来评估,还是对照我实际需要的来评估?”“最好的围巾”不如“最适合我朋友的礼物”重要。

应用10-10-10法则: 在10分钟、10个月、10年后,你对这个选择的感觉会如何?这把重点从外观呈现转到了实质内容。

10.2. 长期策略

建立参考库: 为你经常评估的类别建立“什么是正常的”的心理数据库。你要知道20,000个词条是一本大词典,8盎司是一大份。

练习专注于规格: 训练自己识别并优先考虑难以评估的属性(数量、技术规格、过往记录),而不是容易评估的属性(外观、完整性)。

创建决策框架: 对于重复出现的决策(招聘、采购),制定标准化的比较矩阵,以强制进行联合评估。

与专家校准: 在进入不熟悉的领域时,咨询能够提供参考点的专家(“20,000个词条算多吗?”)。

10.3. 环境设计

强制比较工具: 使用电子表格、比较网站和将选项并排呈现的结构化模板。

魔鬼代言人协议: 在群体决策中,指定一个人来为“更混乱”选项的优点辩护。

推迟决定: 在看到选项和做出决定之间设定等待期,让分析思维跟上最初的印象。

移除展示线索: 在可能的情况下,在看到包装或展示之前,仅凭规格来评估选项。

10.4. 何时寻求外部意见

在以下情况下咨询他人:

  • 你处于一个不熟悉的类别,缺乏个人参考点
  • 该决定涉及大量资源
  • 你发现自己被展示方式所左右
  • 存在多个选项,但你只能一次看一个

询问顾问:“抛开这些的外观不谈,哪一个能提供更多我实际需要的东西?”


11. 实用练习

练习1:比较矩阵

  • 目标: 培养联合评估的习惯
  • 所需时间: 15分钟
  • 所需材料: 纸或电子表格,一个待定的决定
  • 难度级别: 初学者
  • 说明:
    1. 找出你目前面临的包含2-3个选项的决定
    2. 将所有选项列为列标题
    3. 确定5-7个相关属性(包括易于评估和难以评估的属性)
    4. 用客观数据(数量、规格)填写每个单元格
    5. 使用相同尺度对每个选项的每个属性进行评分
    6. 汇总得分并与你的初始印象进行比较
  • 反思问题:
    • 我最初忽略了哪些属性?
    • 联合评估后,我的偏好改变了吗?
    • 是哪些“容易的”属性驱动了我的初始印象?
  • 频率: 每周一次,持续4周,然后用于所有重大决定

练习2:类别校准

  • 目标: 建立参考点库
  • 所需时间: 20分钟
  • 所需材料: 互联网接入,笔记本
  • 难度级别: 中级
  • 说明:
    1. 选择一个你经常做决定的类别(电子产品、餐厅等)
    2. 研究所选类别关键规格的“典型”和“优秀”基准
    3. 写下参考点:“一台好的笔记本电脑有X大小的内存;优秀的一台有Y大小”
    4. 在下次购买此类商品之前,请查阅你的校准笔记
    5. 随着你了解的增多更新笔记
  • 反思问题:
    • 我的直觉与实际基准偏差有多大?
    • 有哪些规格是我不知道如何评估的?
    • 这如何改变了我将要寻找的东西?
  • 频率: 每月一次,用于新的类别

练习3:反转框架

  • 目标: 对展示效果产生免疫力
  • 所需时间: 10分钟
  • 所需材料: 产品照片或选项描述
  • 难度级别: 高级
  • 说明:
    1. 找两款相似产品的不同版本(不同包装、不同展示方式)
    2. 明确区分“易于评估的”(外观)与“难以评估的”(数量)
    3. 想象展示方式反转过来了,那时候你会怎么想?
    4. 仅根据难以评估的属性做出选择
    5. 反思展示方式最初是如何影响你的
  • 反思问题:
    • 展示方式在多大程度上驱动了我的初步反应?
    • 如果我根据展示方式做出选择,我会觉得被“骗了”吗?
    • 在未来的决策中,我该如何优先考虑实质内容?
  • 频率: 每周练习

日常练习

规格检查: 在进行任何20美元以上的购物之前,暂停一下并明确指出决定客观价值的关键数量或规格。把它写下来。你的选择是针对该规格还是针对展示外观而优化的?

  • 建议时长:每个决定2分钟
  • 一天中最佳时间:购物或评估选项时
  • 如何追踪进度:记录你的决定,以及是规格还是展示方式驱动了你的选择

每周挑战

不完美选项: 每周一次,刻意选择一个实质更优但展示外观较差的选项。点那份份量更大但摆盘更随意的菜。买那个有空隙没装满的大容器。观察实际使用体验与最初印象的对比。

  • 4周后的预期结果:降低对展示外观的敏感度,对“不完美”的高价值选项感到更自在
  • 用于反思的日志提示:
    • 我对“不完美”选项的满意度随时间推移有何变化?
    • 我最初基于展示外观的反应对实际价值的判断准确吗?
    • 我身上带着哪些需要更新的类别假设?

12. 针对特定受众

给领导者和管理者

招聘流程: 永远不要在没有比较矩阵的情况下依次评估候选人。在进行任何招聘讨论之前,要求基于预定义标准进行并排打分。

项目优先级排序: 在审查提案时,强制实行联合评估。创建标准化模板以比较所有选项的影响力、可行性和资源需求。

团队决策: 培训团队区分“易于评估”和“难以评估”的属性。指派魔鬼代言人来支持实质性好但不完美的选项。

绩效评估: 使用标准化的量规同时评估所有团队成员,而不是依次评估。难以评估的贡献(指导新人、建立长期基础)需要明确的指标。

给家长和教育工作者

教授比较技能: 让孩子练习并排比较选项。“哪一堆积木更多?”建立起参考点。

送礼课程: 与孩子讨论为什么“同类最佳”的礼物并不总是最有价值的。教他们思考收礼者真正需要的是什么。

媒体素养: 帮助孩子理解展示方式(包装、广告)与实质内容是不同的。练习识别“盒子里真正装的是什么”。

适合年龄的活动: 对于幼儿,使用具体的比较(哪个碗里的麦片更多?)。对于大一点的孩子,讨论广告商如何利用展示方式来影响消费者的选择。

给医疗保健专业人员

治疗讨论: 以对比的方式而不是顺序呈现治疗方案。使用并排展示结果的决策辅助工具。

诊断沟通: 将部分诊断结果定性为有价值的数据点,而不是“不完整”的结果。帮助患者对照适当的参考点来评估信息。

患者教育: 教导患者通过疗效(难以评估)而不是方便或简单程度(易于评估)来衡量治疗方案。

给金融专业人士

客户演示: 使用标准化的指标进行投资选项的对比演示。避免可能引发单独评估的顺序演示。

费用透明度: 使各项选择的费用结构具有可比性。在单独评估中,客户因为缺乏参考点而低估了低费率的价值。

行为辅导: 帮助客户建立关于何为“好”回报的参考点,从而抵御那些表面光鲜但表现不佳的基金的诱惑。


13. 与其他偏差的交互作用

放大此效应的偏差

偏差 它如何交互影响
情感启发式 对外观展示的情感反应(对破损部件的厌恶)压倒了对数量的分析评估
锚定偏差 最初基于外观展示的印象锚定了随后的价值评估
光环效应 单一负面特征(破损部件)污染了对无关属性(总数)的评估
现状偏差 一旦我们做出了基于外观展示的选择,我们就会抗拒证明我们选错的证据

抵消此效应的偏差

偏差 它如何提供帮助
分析思维倾向 更倾向于追求规格数据而非直觉印象的自然倾向
最大化倾向 寻找“最好”选项的驱动力促使进行对比评估
损失规避(在联合评估中) 害怕“失去”较大选项中潜在价值的恐惧

常见偏差链

单独评估 → 少即是多 → 情感启发式 → 事后合理化

在孤立地评估选项时,少即是多效应创造了对“光鲜完美”选项的偏好。情感启发式对这一选择产生积极情绪。然后,事后合理化为这种基于展示外观的选择构建理由(“质量重于数量”)。

通过在第1步强制进行联合评估来阻断偏差链,在情绪有机会巩固偏好之前采取行动。


14. 文化视角

埃尔克·韦伯(Elke Weber)和克里斯托弗·奚(Christopher Hsee)的跨文化研究表明,少即是多效应在不同文化中都有体现,尽管存在一些差异:

普遍方面:

  • 基本机制(单独评估与联合评估对比)似乎是普遍的
  • 相对类别的评估在不同文化中均起作用
  • 发展研究表明,这种效应在3岁的儿童中就已出现,这是认知根源很深的一个迹象

文化差异:

  • 风险认知在不同文化中的中介作用不同,什么算作“有缺陷”存在差异
  • 根据文化对象征主义与实用性的侧重,送礼规范会放大或减轻类别效应
  • 集体主义文化可能对展示中的社会信号方面更敏感
文化类型 表现形式
个人主义文化 关注个人效用;当规格对较大的选项有利时,可能更容易克服展示方式的影响
集体主义文化 礼物的社会信号方面更加突出;“同类最佳”具有额外分量
高语境文化 展示被解读为更丰富的交流;“没装满的杯子”带有更多的负面社会意义
低语境文化 在受到提示时,更容易接受基于规格的评估

韦伯和奚(1998年)的研究表明,在追求风险方面明显的跨文化差异,实际上是由对何为风险的不同认知(可评估性差异)所介导的,而不是风险偏好上的根本差异。


15. 神话与误解

误区 现实
“少即是多效应意味着人们是不理性的” 理性主义的批评(谢尔和麦肯齐)表明,在社会背景下,展示方式确实传达了信息。偏好满溢的杯子可能是对摊贩慷慨程度的理性推断。
“你可以通过提高意识来消除这种偏差” 意识到这一点有帮助,但并不能消除这种效应。关键在于环境设计——通过工具和流程强制进行联合评估。
“这只影响天真的消费者” 专家也容易受影响,特别是当他们在自己的专业领域之外进行评估或面临时间压力时。这种效应甚至在3岁的儿童中就出现了。
“大总是客观上更好的” 这种偏差并不意味着数量总是取胜,而是说我们应该有意识地评估数量,不要默认于基于展示方式的判断。有时,较小、完整的选项确实能更好地满足我们的需求。
“这和诱饵效应是一样的” 诱饵效应需要三个选项(目标、竞争者、被支配的诱饵)。少即是多效应发生在孤立评估的单个选项上,不需要诱饵。

16. 专家见解

“偏好是被构建出来的,而不是被检索出来的。人类的心智并不在绝对的效用尺度上运作——它在基于情境、易感性和可评估性的相对尺度上运作。” —— 克里斯托弗·奚,芝加哥大学

“对事物的评估不是在真空中进行的,而是相对于该事物类别所唤起的‘规范’或原型进行的。” —— 丹尼尔·卡尼曼和戴尔·米勒,规范理论(1986年)

“在社交环境中,‘框架’的选择泄露了说话者参考点的信息。少即是多效应可能不是处理数量上的失败,而是处理社会信号的成功。” —— 什洛米·谢尔和克雷格·麦肯齐,信息泄漏解释(2014年)

“为了推动最优选择,人们必须改变评估模式。人们必须从单独评估的孤立状态走向联合评估的清晰状态。” —— 摘自奚氏研究项目的综合结论


17. 核心要点

  1. 单独评估与联合评估: 相同的选项,其价值可能会因为是单独呈现还是与替代方案并排比较而产生截然不同的评估。

  2. 在孤立状态下易评估的属性占主导: 当我们缺乏对比数据时,我们会默认使用容易判断的属性(完整/破损、满/空),而不是需要基准点的属性(数量、规格)。

  3. 偏好是构建而成的: 我们对事物并没有内在的“价格标签”,估值是我们根据当前的上下文和类别规范当场建立起来的。

  4. 解决之道在于联合评估: 强制使用矩阵、电子表格和结构化决策流程来进行并排比较。

  5. 展示外观并不总是骗人的: 有时候满溢的杯子确实标志着慷慨。我们的目标不是忽略展示方式,而是要有意识地将它与实质内容一起评估。

  6. 这种效应是普遍且深刻的: 它出现在跨文化背景以及最小3岁的儿童中,这指向的是基础的认知架构,而不是习得的行为。

  7. 高风险决策需要格外小心: 对于重要的选择(招聘、大宗采购、战略决策),应投入精力建立比较框架,而不是轻信孤立的印象。


18. 更多资源

学术论文

  • 奚(Hsee, C. K.). (1996). 可评估性假说:对替代方案联合评估与单独评估之间偏好逆转的一种解释. 《组织行为与人类决策过程》, 67(3), 247-257.
  • 奚(Hsee, C. K.). (1998). 少即是多:当低价值选项比高价值选项获得更高估值时. 《行为决策制定杂志》, 11(2), 107-121.
  • 谢尔(Sher, S.),& 麦肯齐(McKenzie, C. R.). (2006). 逻辑等价框架中的信息泄漏. 《认知》, 101(3), 467-494.
  • 韦伯(Weber, E. U.),& 奚(Hsee, C. K.). (1998). 风险感知的跨文化差异,但对待感知风险态度的跨文化相似性. 《管理科学》, 44(9), 1205-1217.
  • 奚(Hsee, C. K.),张姣(Zhang, J.),卢卓娅(Lu, Z. Y.),& 徐(Xu, F.). (2013). 单位请求:一种促进捐赠及超越的方法. 《心理科学》, 24(9), 1801-1808.

书籍

  • 卡尼曼(Kahneman, D.). (2011). 《思考,快与慢》. 法勒、施特劳斯和吉鲁出版社.
  • 泰勒(Thaler, R. H.),& 桑斯坦(Sunstein, C. R.). (2008). 《助推:如何做出有关健康、财富与幸福的最佳决策》. 耶鲁大学出版社.
  • 艾瑞里(Ariely, D.). (2008). 《怪诞行为学:可预测的非理性》. 哈珀柯林斯出版社.

书籍章节

  • 奚(Hsee, C. K.),& 张姣(Zhang, J.). (2010). 一般可评估性理论. 《心理科学视角》, 5(4), 343-355.

19. 总结卡片

要素 内容
偏差名称 少即是多效应(Less-is-Better Effect)
定义 在单独评估时,偏好较小“完整”的选项,而不是较大“不完美”的选项
类别 意义不足
关键特征 基于外观/完整性而非数量/规格的强烈偏好
主要原因 缺乏比较数据时,容易评估的属性占据主导地位
最大风险 在生活各个领域中系统性地选择客观上较差的选项
快速修复 在做决定之前创建并排比较
长期策略 为频繁评估的类别建立参考点库
切记 “要比较,别只是评估:满溢的杯子里的冰淇淋可能反而更少”

20. 术语表

术语 定义
单独评估(SE) 一次评估一个选项,而不与替代方案直接比较
联合评估(JE) 同时评估多个选项并进行并排比较
可评估性 决策者判断一个属性值好坏的难易程度
易于评估(EE)属性 无需外部参考即可判断的特征(如:破损/完好,满/空)
难以评估(HE)属性 需要比较基准才能判断的特征(如:“20,000个词条算多吗?”)
规范理论 认为事物是相对于类别原型进行评估的,而不是以绝对条件评估的理论
属性替代 用较容易的判断代替较难的判断(如:“这值多少钱?”变成了“破损了多少?”)
范围不敏感 当数量无法在没有基准的情况下评估时,对数量级差异不敏感
单位请求 一种捐赠技巧,即在进行群体捐赠之前先询问单位价值,以建立参考点
信息泄漏 认为框架(如杯子大小)传递了超出其字面内容的隐含信息的理论
支付意愿(WTP) 消费者愿意为某商品支付的最高价格,也是LiBE实验中的标准衡量指标

21. 讨论问题

供读书俱乐部、课堂讨论或自我反思:

  1. 回想一下最近的一个决定,你选择了一个“更小但更好看”的东西,而不是“更大但不完美”的东西。回想起来,你做出的选择是对的吗?

  2. 少即是多效应会如何影响政治话语?你能想到哪些政策之所以成功,是因为它们是“针对小问题的完整解决方案”,而不是“针对大问题的部分解决方案”吗?

  3. 理性主义的批评认为,偏好满溢的杯子可能是对摊贩慷慨程度的理性推断。在哪些情况下,少即是多效应实际上是适应性的而非一种偏差?

  4. 意识到这种效应后,你送礼的方式会有什么改变?你向他人展示自己工作成果的方式会有什么改变?

  5. 这种效应甚至出现在最小3岁的儿童中。这说明它究竟是习得的行为还是基本的认知架构?这对教育有什么启示?