专题篇章 · AI 产品心理学 劳动错觉:让 AI 把努力演出来 第 2 课说等待要有反馈,这一课的结论更反直觉: 有些等待根本没必要消灭 。展示工作过程的产品,让用户多等几秒,满意度和信任反而更高。这个效应叫劳动错觉(Labor Illusion)。先做实验,再看研究,最后把边界画清。 一句话速览 哈佛实验:展示工作过程让用户多等反而更满意。秒回 vs 过程外显的 A/B 投票实验,思考外显与检索来源的一鱼三吃,外加三条不能越过的边界 先做实验 · 两个机器人,你信哪个 同一个问题同时发给两个客服机器人, 答案一字不差 ,区别只在拿到答案的方式。A 秒回,B 花 3 秒把工作日志逐条亮出来再作答。跑完凭直觉投票。
秒回 vs 过程外显 先跑再投
点「同时提问」,两边一起盯着看,留意自己的直觉往哪边偏。
机器人 A · 秒回 0.3 秒直接给答案 「这份合同里的竞业限制条款有什么风险?」 点下方「同时提问」开始 我更信 A 的答案
机器人 B · 展示过程 3.5 秒,工作日志逐条亮起 「这份合同里的竞业限制条款有什么风险?」 点下方「同时提问」开始 我更信 B 的答案
同时提问 两边答案一字不差
研究出处 · 让用户多等 60 秒的网站赢了 这个效应出自哈佛商学院 Buell 和 Norton 2011 年的实验。被试在模拟的机票搜索网站上查航班:一组秒出结果,另一组要等 30 到 60 秒,但屏幕上滚动着「正在检查 Delta 航空…正在检查 United…」。结果 展示劳动的那组满意度反超 ,部分条件下被试宁愿选等 60 秒但看得见工作的网站。下面把实验搬给你亲手跑。
复刻 Buell & Norton 的机票实验 0 / 2 版已试
两个版本各搜一次。真实实验里劳动版要等 30 到 60 秒,这里压缩成几秒,意思到位就行。
Flight Seek 上海 PVG → 西雅图 SEA · 10 月 14 日 选好版本,点「搜索航班」
秒出结果版 展示劳动版
搜索航班
该版满意度
--
机制一句话:人用看得见的努力,推断看不见的质量。 搜索到底查得细还是查得糙,用户没法直接看见,于是拿「屏幕上的工作量」当质量的代理指标。咨询师当场给方案显得不值钱,说「容我回去分析三天」反而显得专业,同一回事。
动手装配 · 把 AI 的努力摆上台面 工程上你有三根现成的杠杆:推理模型的思考过程、RAG 的检索来源、Agent 的工具调用日志。它们原本是调试信息,摆上台面就成了体验资产。 三个开关逐个拨开,看右边的聊天界面多出什么、体感可信度涨多少。
过程外显装配器 可信度 42
思考过程外显 把思维链摊开:分了几种情况、在哪换过思路,让用户看见推理的骨架。
检索来源逐条亮出 「已检索 3 个来源」加上可点开的条目,答案挂上可查验的出处。
工具调用日志 查了什么、读了什么、比对了什么,一步一行摊在屏幕上。
体感可信度
42
「答得挺快,但这话我敢直接转给 HR 吗…还是再问问别人。」
帮我查一下:员工试用期被辞退,赔偿怎么算? 思考了 4 秒 ⌄ 用户问的是试用期解除的赔偿…得分两种情况:公司拿得出「录用条件不符」的证据,和拿不出的…先查劳动合同法原文再作答,避免凭印象给数字。 已检索 3 个来源 《劳动合同法》第 21 条 《劳动合同法》第 39 条 劳动争议司法解释(一) ✓ search_law("试用期 解除 赔偿") · 3 条结果 ✓ read_doc(劳动合同法 §21, §39) ✓ cross_check(司法解释一 §44) 分两种情况:公司能证明你「与录用条件不符」的,可以解除且无需赔偿;拿不出证明的属于违法解除,按 2N 标准赔偿。注意举证责任在公司一侧,你只需保留录用通知和考核记录。
全开之后清点一下,你收获的可远超一个错觉: ① 看得见的努力制造了劳动错觉,这是本课;② 来源和日志给了用户可核验的抓手,这是第 5 课信任校准的主角;③ 用户顺带看懂了系统的工作方式,心智模型自己长出来了,这是第 8 课的主题。一鱼三吃,头部产品把调试信息搬上台面,图的就是这三层。
火眼金睛 · 揪出假劳动 过程展示有真有假。下面三个界面都在「展示努力」, 逐个判断:真劳动,还是假表演? 拆穿的代价,三题做完揭晓。
假进度找茬 0 / 3
样例 ② 和 ③ 是活的,多盯几秒再下判断。
样例 ① · 检索日志
✓ 检索「二手房 定金 退还」· 4 篇 ✓ 读取《民法典》第 587 条 ✓ 比对 2 个近似判例 定金能退的前提是对方违约或双方协商解除 [民法典 §587] ,你这种情况属于卖方违约,可主张双倍返还。
真劳动 假表演
样例 ② · 深度思考中
正在深度思考… 已思考 0 秒
真劳动 假表演
样例 ③ · 进度条
4%
真劳动 假表演
为什么假劳动是信任炸弹: 被拆穿一次,用户会把这套把戏泛化到你产品的每个角落,之后真实的检索日志、真实的思考过程,都会先被当成表演审视一遍。劳动错觉的红利建立在「劳动真实发生」上,造一次假,真的也跟着贬值。
边界三问 · 演之前先过三关 劳动错觉好用,但有边界。三道题,每道对应一条实践红线,做完这一课的杠杆就能放心用了。
第一问 · 什么时候该收着演 选一个
下面三个场景,哪个该收起过程展示、直奔结果?
A 用户第一次用你的产品,生成一份年度经营分析 B 翻译按钮,用户每天要点几十次 C 法律条款审查,结果对错用户自己难验证
第二问 · 演多久算过头 选一个
过程展示的时长,红线画在哪?
A 用户能忍多久,就演多久 B 真实劳动花了多久,就最多演多久 C 比竞品略长一点,显得更下功夫
第三问 · 能不能故意拖慢 选一个
后端 0.4 秒算完了,产品经理提议硬加 3 秒延迟、播一段「努力动画」,接吗?
A 接,反正实验证明慢一��用户更满意 B 驳回,实验的前提是劳动真实发生,硬加的 3 秒是造假 C 折中,加 1.5 秒,用户察觉的概率低
出处与延伸: 劳动错觉主实验见 Buell & Norton (2011), The Labor Illusion: How Operational Transparency Increases Perceived Value , Management Science;后续研究把话题扩展为运营透明度(Operational Transparency),Buell, Kim & Tsay (2017) 在餐厅场景验证了双向透明还能同时提升顾客满意与员工表现。原始论文里常被漏读的一条前提: 劳动错觉只在结果合格时生效 ,答案砸了,用户看过的努力过程只会变成新的槽点:查了 12 篇文档还答成这样?
✅ 这一课想和你分享的
把真实的劳动亮出来 :思考过程、检索来源、工具日志,调试信息搬上台面就是体验资产 用可核对的细节演 :日志条目要能和答案里的引用对上,可验证的过程越看越可信 展示时长锁在真实耗时之内 :呈现节奏可以放慢,超出真实劳动时长就是造假 高频任务收着演 :第一次展示过程建立信任,之后直奔结果,别拿用户的耐心铺排面