专题篇章 · AI 产品心理学:设计用户的感受

工程指标及格了,用户为什么还骂慢?

同一个 5 秒请求,空白冻结、转圈、流式、步骤外显四种呈现并排跑,亲身体验物理时长相同、体感差三倍;再认识用户秒表的三个走时怪癖

本页解决的问题

先给结论

工程指标及格了,用户为什么还骂慢?

同一个 5 秒请求,空白冻结、转圈、流式、步骤外显四种呈现并排跑,亲身体验物理时长相同、体感差三倍;再认识用户秒表的三个走时怪癖

判断标准

把品味变成产品可重复的行为。 有用的结果不是一句“我觉得更好”。它应该是一条看得见的规则、一个小例子,以及判断体验何时低于标准的方法。

下一步

记录一个前后对比,让别人不用听解释也能看懂质量线。

常见误区

表面更精致了,却没有减少用户的不确定感。

实验一 · 同一个 5 秒,四种活法

下面四个面板背后是同一次请求:同一个问题,同样 5 秒出完整答案。区别只有一个:这 5 秒里给用户看什么。点按钮让四个同时开跑,留意自己的体感。

四方案并排跑 先开跑
跑完之后,点你觉得最难受的那个面板。

方案 A · 空白冻结

什么都不给
点下方按钮开始
0.0s

方案 B · 转圈等待

告诉你它活着
点下方按钮开始
0.0s

方案 C · 流式输出

先给一部分
点下方按钮开始
0.0s

方案 D · 步骤外显

让你看它在干嘛
点下方按钮开始
0.0s
物理时长一模一样:都是 5 秒
实验二 · 先校一校你的体内秒表

刚才多数人最难受的是空白面板。空白除了难受,还有个隐藏代价:它会放大你对时长的估计。感知时间研究把「一边等一边关注时间」的计时叫前瞻计时:注意力越多押在时间本身上,主观时长越膨胀,紧张情绪再把它拉长一截。Zakay 与 Block 的注意闸门模型是这条规律最常被引用的解释。结论先放这,你自己测一遍更有说服力。

凭体感掐 8 秒 未开始
(准备好了就点右边的「开始」)

点「开始」后,左边面板会进入一段没有进度、没有转圈、没有文案的等待。凭体感,觉得过了 8 秒就按停。尽量别在心里数拍子,那是作弊。

你以为的8.0s
实际走过0.0s
偏差0%

这就是空白冻结在数据后台看不见的那笔账:服务器记 5 秒,用户记 6 秒半。无反馈等待的高估误差,实验里两三成很常见。你产品的「体感延迟」比监控面板上的 P99 更糟,且差距由界面决定。

实验三 · 首字时间是根多长的杠杆

秒表既然开在用户心里,工程预算就要花在他计时的区间。下面这台聊天机器人的总时长锁死 5 秒,你只能动一个参数:首字时间 TTFT(从发送到看见第一个字)。拖滑块,点「重放」,右边按所选 TTFT 重演一次打字流,体感分跟着变。

TTFT 滑块 · 总时长不变 拖一拖再重放
2.4s
总时长固定 5.0s,只动首字
体感分
64
帮我把这段会议纪要缩成三条待办
点「重放」看这一档 TTFT 的体感
为什么工程上先压 TTFT:把首字从 5 秒压到 0.5 秒,总时长一秒没省,体感分翻了两三倍;反过来 TTFT 不动、总时长从 5 秒压到 4 秒,这根表几乎不动。接流式、先出提纲、分段返回,性价比都排在升级机器前面。
实验四 · 用户秒表的三个走时怪癖

把前面的体感整理成三条可复用的规律。每一档都有个 mini 演示,三档都切一遍

三个走时怪癖 1 / 3 档
用户的秒表
0.6s · 看见第一个字,秒表停
服务器的秒表
5.0s · 完整答案落地

用户的开表点在按下发送,收表点在看见第一个字。首字之后他的注意力交给了阅读,边读边到的内容几乎没被记进等待的账本。工程团队盯总时长的 P99,用户只记首字,两块表对不上,差评就从缝里钻出来。实验三里 TTFT 那根杠杆的长度,就是这条怪癖给的。

裸奔
带播报
同样 6 秒,哪根更煎熬?

同一次等待:5 秒后答案落地。切换两种结局,看回忆里的时长怎么变。

「等了一小会儿就出来了,答案挺到位,这工具行。」
回忆里的时长
约 4 秒

物理上都是那一次 5 秒。追记式的时间靠事后重建,情绪越糟,重建出来的等待越长。所以延迟和幻觉在差评里常常挤进同一句话:又慢又蠢。答案质量的问题会连坐到速度头上;反过来,好答案也能替你把慢遮掉一截。第 4 课峰终定律会把这条用在结尾设计上。

立论 · 用户拿感知那块表给你打分

AI 产品有三个天生毛病:(推理要时间)、会错(幻觉压不净)、不透明(用户看不见它在干嘛)。工程手段短期内只能缓解这三样,但用户的评价由感知产生,感知可以设计。你在前面章节学的流式输出、模型路由、语义缓存、Agent 进度汇报,每一个都还有一重心理学开关的身份,这一章教你什么时候为了心理效果去拨它。

感知性能 ≠ 真实性能。服务器的 5 秒是物理事实,用户的 5 秒是心理事件;打分、续费、卸载,都发生在后一个 5 秒里。
出门考 · 预算只够动一刀 选一个
你的 AI 助手被用户骂慢,实测总时长 5 秒、首字 4.2 秒。手上的排期只够做一件事,先动哪刀?
A升级推理集群,把总时长从 5 秒压到 4 秒
B接入流式输出,首字压到 0.5 秒,总时长不变
C换一个更精致的加载动画,转圈升级成粒子特效
D弹一个提示框,向用户解释模型正在深度思考
全章地图 · 十六课怎么接着讲

慢、会错、不透明,每个毛病后面都排着几课;再往后是关系和钱。点卡片翻面,看每一课要解决用户的哪句抱怨。

十六课一张图 0 / 16 已翻
出处与延伸:感知时间的注意闸门模型见 Zakay 与 Block 的系列研究(1990 年代起),无反馈与高唤起状态下的时长高估在前瞻计时实验里反复复现;等待体验的经典整理见 David Maister《The Psychology of Waiting Lines》(1985),「被占住的时间感觉更短、没解释的等待感觉更长」出自这里;界面响应的 0.1 / 1 / 10 秒三档见 Nielsen《Usability Engineering》(1993);进度指示器让用户偏好与耐心上升的实验见 Myers(1985)。情绪改写时间记忆的机制与第 4 课峰终定律(Kahneman 等)同根。

从「实验一 · 同一个 5 秒,四种活法」把感觉变成判断

「下面四个面板背后是 同一次请求 :同一个问题,同样 5 秒出完整答案。区别只有一个:这 5 秒里给用户看什么。点按钮让四个同时开跑,留意自己的体感」指出,AI 降低了做出“能用”成品的门槛,读者真正需要练的是看出哪里不对,并把感觉说成可以执行的要求。

观察用户的下一步,而不是只看表面

「刚才多数人最难受的是空白面板。空白除了难受,还有个隐藏代价: 它会放大你对时长的估计 。感知时间研究把「一边等一边关注时间」的计时叫前瞻计时:注意力越多押在时间本身上,主观时长越膨胀,紧张情绪再把它拉长一截。Zakay 与 Block 的注意闸门模型是这条规律最常被引用的解释。结论先放这,你自己测一遍更有说服力」可以转成几个可观察的问题:用户是否知道现在发生了什么,是否知道下一步做什么,出错或空白时能否恢复,以及信息层级是否让重要内容先被看见。

  • 盯两块秒表 :服务器计物理时长,用户从发送计到首字,考核指标里给 TTFT 单开一行
  • 别让界面空白 :无反馈等待会被放大两三成,超过 1 秒就给反馈,超过 3 秒就给进展
  • 预算先压首字 :接流式、先出提纲、分段返回,排期都在升级机器前面

漂亮不等于容易用

把「慢、会错、不透明,每个毛病后面都排着几课;再往后是关系和钱。」用在第二个页面或流程上,记录一个具体犹豫点和一个改动后的用户动作;能被观察到的变化,才是体验改善。

从「实验一 · 同一个 5 秒,四种活法」走到「实验二 · 先校一校你的体内秒表」

「实验一 · 同一个 5 秒,四种活法」先把问题落在「下面四个面板背后是 同一次请求 :同一个问题,同样 5 秒出完整答案。区别只有一个:这 5 秒里给用户看什么。点按钮让四个同时开跑,留意自己的体感」上;到了「实验二 · 先校一校你的体内秒表」,讨论继续推进到「刚才多数人最难受的是空白面板。空白除了难受,还有个隐藏代价: 它会放大你对时长的估计 。感知时间研究把「一边等一边关注时间」的计时叫前瞻计时:注意力越多押在时间本身上,主观时长越膨胀,紧张情绪再把它拉长一截。Zakay 与 Block 的注意闸门模型是这条规律最常被引用的解释。结论先放这,你自己测一遍更有说服力」。两段连起来,重点就不只是记住一个结论,而是看清它成立所依赖的条件。

把这条判断带到下一个场景

评估体验时,把抽象的“好看”或“顺手”换成用户动作:他是否看懂状态、找到了下一步、能从错误中恢复,并且愿意继续使用。

  • 「实验一 · 同一个 5 秒,四种活法」:下面四个面板背后是 同一次请求 :同一个问题,同样 5 秒出完整答案。区别只有一个:这 5 秒里给用户看什么。点按钮让四个同时开跑,留意自己的体感
  • 「实验二 · 先校一校你的体内秒表」:刚才多数人最难受的是空白面板。空白除了难受,还有个隐藏代价: 它会放大你对时长的估计 。感知时间研究把「一边等一边关注时间」的计时叫前瞻计时:注意力越多押在时间本身上,主观时长越膨胀,紧张情绪再把它拉长一截。Zakay 与 Block 的注意闸门模型是这条规律最常被引用的解释。结论先放这,你自己测一遍更有说服力
  • 「最后的要点」:错误当场兜住 :时间记忆跟着情绪走,答非所问会把慢一起写进差评

最后的「最后的要点」把讨论落到「错误当场兜住 :时间记忆跟着情绪走,答非所问会把慢一起写进差评」。回看这条线索时,最值得保留的是:当输入、规模或风险改变,哪些判断需要重新做一遍。

✅ 这一课想和你分享的

  • 盯两块秒表:服务器计物理时长,用户从发送计到首字,考核指标里给 TTFT 单开一行
  • 别让界面空白:无反馈等待会被放大两三成,超过 1 秒就给反馈,超过 3 秒就给进展
  • 预算先压首字:接流式、先出提纲、分段返回,排期都在升级机器前面
  • 错误当场兜住:时间记忆跟着情绪走,答非所问会把慢一起写进差评
标记为已学完 阅读进度会自动记录
← 上一篇下一篇 →

继续阅读

同一条线上的下一篇。

文章讨论

读到这里,留下一个判断。

把刚想明白的地方、还没想通的问题,留给下一位一起学习的人。

正在讨论 工程指标及格了,用户为什么还骂慢? AI 产品心理学:设计用户的感受
3条讨论文章讨论 · 与共学社区同步
在共学社区查看
AM
Asha Morgan内容编辑
观点实践记录

我把这篇文章里的一个判断改写成了今天可以验证的小实验。比记住结论更有用的是,知道下一步要观察什么。

文章讨论7 有帮助
LH
Lin Harper独立开发者
观点观点

读完以后我先回头找它成立的条件,而不是直接把方法搬进项目。这个顺序让后面的取舍清楚很多。

文章讨论5 有帮助
KM
Kiki Moore产品运营
问题问题

如果把这个判断放到真实工作里,最先需要补的约束是什么?我想知道从阅读到第一次实践之间,哪一步最值得先做。

文章讨论4 有帮助