比较最常见的调查评分量表——李克特量表、NPS、星级评分、语义差异量表、CSAT 和 CES——并了解哪种量表适合哪种测量目标。
评分量表把意见转化为数字,而你所选择的量表会悄然塑造随后的一切——受访者如何理解问题、你如何分析数据,以及你如何进行跨时段的基准比较。五点式李克特量表、十一点式净推荐值问题和五星评分并不能互换;每一种都带有各自的假设与取舍。本指南将比较最常见的几种评分量表,助你把合适的量表与你的测量目标相匹配。
评分量表基础
有几项设计抉择适用于每一种量表。点数:点数越多,能捕捉的区分就越精细,但也会增加认知负担;五点和七点是常见的最佳平衡点。奇数与偶数:奇数点数提供一个中立的中间点,而偶数点数则通过去掉中间点,迫使受访者朝某个方向倾斜。标注:为每一个点都完整标注可提升清晰度与一致性,而只标注两端则给予受访者更大的解读自由。平衡:正面点与负面点应当对称,以免量表把受访者引向某一边。把这些基本要素做对,比你选择哪一种有名号的量表更为重要。
李克特量表
李克特量表衡量对某一陈述的赞同程度,经典形式为从"非常不同意"到"非常同意"的五个点,有时扩展为七个点。它是态度测量的主力——灵活、为人熟知且易于分析。而真正的李克特量表会把若干相关的李克特条目合并为一个综合分数,从而比任何单一条目都更可靠地测量某一潜在态度。
优点:受访者一望便知,而且其数据支持丰富的分析(各条目的均值、分布和信度检验)。缺点:它易受默许偏差(倾向于同意)和趋中作答(扎堆于中立的中间点)的影响。为对抗这些,可将部分条目以反向方式表述,尽可能采用针对具体条目的措辞,并思考中立的中间点究竟是有所助益,还是只是让受访者得以回避明确表态。
净推荐值(NPS)
NPS 只问一个问题——"您向朋友或同事推荐我们的可能性有多大?"——采用从 0 到 10 的十一点式量表。受访者被分为推荐者(9—10)、被动者(7—8)和批评者(0—6)。得分即推荐者的百分比减去批评者的百分比:具体而言,即推荐者百分比减去批评者百分比,得出一个从 -100 到 +100 的数值。被动者计入总数,但不计入得分。
NPS 之所以广受欢迎,是因为它简单、举世通用且被广泛用作基准,这使它非常适合跨时段追踪忠诚度并与行业标准相比较。它的局限也确实存在:单单一个数字掩盖了背后的原因,各类别的分界线多少有些武断,而同一个 NPS 可能来自差异极大的分布。请务必为该得分配上一个开放式追问,询问其原因。若想正确地部署它,请从一份专门的 NPS 调查入手,而不要手动重建量表。密切关注留存率的 SaaS 初创公司尤其常做忠诚度追踪。
CSAT 与客户费力度得分
CSAT(客户满意度得分)询问客户对某次具体互动的满意程度,通常采用从"非常不满意"到"非常满意"的 1 到 5(或 1 到 7)量表。得分往往以选择最高一档或两档的受访者百分比来呈现。CSAT 最适合在某个离散的接触点——一张支持工单、一次购买、一个入门步骤——发生后立即衡量对它的满意度。
CES(客户费力度得分)衡量客户不得不付出多少努力,通常做法是就诸如"该公司让我处理问题变得很容易"这样的陈述,在 1 到 7 的量表上评定赞同程度。对于服务类互动而言,CES 是未来忠诚度的有力预测指标,其逻辑在于:减少阻力比取悦客户更能可靠地留住客户。用 CSAT 来衡量满意度,用 CES 来诊断阻力;二者相辅相成。
星级评分与语义差异量表
星级评分(通常为 1 到 5 星)凭借电商和应用商店而为人熟知、直观易懂,这使它非常适合面向公众的评价和快速的产品反馈。它的缺点在于解读的漂移——一个人心中的四星是另一个人的三星——以及一种有充分记录的、偏向极端评分的倾向,因此在缺乏足够数量的情况下,均值可能具有误导性。
语义差异量表在两端各放置一对相反的形容词(例如"不可靠"到"可靠",或"廉价"到"高端"),并请受访者标出其印象落在何处,通常横跨五到七个点。它们在品牌与认知研究中威力强大,因为它们能同时沿多个维度捕捉某个产品或公司的内涵。要发挥其效力,需要精心挑选真正呈两极对立的形容词对,这使它们更适合一份深思熟虑的市场调研问卷,而非一次快速的情绪摸底。
选择合适的量表
从决策出发,而非从量表出发。要衡量忠诚度并对其做基准比较,用 NPS。要衡量对某次具体互动的满意度,用 CSAT。要诊断某个流程中的阻力,用 CES。要就多个条目衡量态度与信念,用李克特量表。对于面向公众的评价,用星级评分。对于品牌认知,用语义差异量表。然后,请让量表在各时段保持一致——中途更改点数或标注,会破坏你比较趋势的能力。最后,用少数几位真实受访者对任何量表加以试测,以确认那些标注所表达的正是你的本意。
有一点微妙却重要,关乎你如何分析量表数据。严格来说,大多数评分量表都是顺序量表:各点是有序的,但点与点之间的间隔并不保证相等,因此从"同意"到"非常同意"的距离,未必等同于从"中立"到"同意"的距离。严格而言,这主张报告中位数和频率分布,而非均值。但在实践中,许多团队仍会报告李克特及类似量表的均值,因为均值便于传达和比较——只要你同时也审视完整的分布,这就是可以接受的。一个均值为 3.0 的五点量表,既可能是整齐地聚集在中间点,也可能是在 1 与 5 之间两极分化,而这两种情形需要截然不同的应对。请务必绘制分布图,而不只是看均值。
移动端的呈现同样值得考量。十一点式的 NPS 一行在狭窄的屏幕上可能会别扭地折行,而七点式、完整标注的李克特条目则可能变得局促。请在发布前于手机上测试每一种量表,因为如今很大一部分调查回答都来自移动设备,而一个在台式机上看着没问题、却在移动端出问题的量表,会悄然拉低完成率与数据质量。若受访者在他们实际使用的设备上误读了它,那么纸面上再好的量表也毫无价值。
常见问题
NPS 得分是如何计算的?在 0—10 量表上,将受访者分为推荐者(9—10)、被动者(7—8)和批评者(0—6),然后用推荐者的百分比减去批评者的百分比。结果的范围为 -100 到 +100;被动者计入基数,但不直接对得分有所增益。
评分量表是否应当有一个中立的中间点?视情况而定。奇数点数给予受访者一个真正的中立选项,当中立确实是一种立场时,这是诚实的做法。偶数点数会迫使受访者倾斜,当你专门想把受访者从骑墙状态中推出来时,这很有用——但它可能会让真正持中立态度的受访者感到懊恼。
李克特量表应当有多少个点?五个点和七个点是最常见、也最经检验的选择。五点更简单、更快捷;七点则提供更精细的区分。超过七点很少能提升信度,反而会增加受访者的付出。
CSAT 与 NPS 有什么区别?CSAT 在某次具体互动发生后立即衡量对它的满意度,而 NPS 衡量的是总体忠诚度和推荐意愿。CSAT 是交易性的、着眼于短期;NPS 是关系性的,用于长期的基准比较。
借助 SurveyMaker,只需点击几下,即可为你的调查添加任意评分量表——李克特、NPS、CSAT 或星级评分。