Employee Experience

用柯克帕特里克模型进行培训评估

对柯克帕特里克模型评估培训的四个层级进行实用讲解,并附有用于测量反应、学习、行为和成果的调查示例。

各组织在培训上投入巨额资金,然而许多组织却难以回答一个基本问题:它奏效了吗?柯克帕特里克模型由唐纳德·柯克帕特里克在 20 世纪 50 年代首次提出,此后经过数十年的完善,至今仍是评估培训成效最广为使用的框架。它把评估拆分为四个层级,从即时的反应一路延伸到对业务的持久影响。本指南逐一讲解每个层级,展示调查在每个阶段如何融入其中,并解释如何在不落入其常见陷阱的情况下运用这一模型。

模型概览

柯克帕特里克模型通过四个依次递进的层级来评估培训。第一层"反应"衡量参与者对培训的感受。第二层"学习"衡量他们实际学到了什么。第三层"行为"衡量他们回到工作岗位后是否应用所学。第四层"成果"衡量对业务结果的影响。

各层级彼此叠加。正面的反应并不保证学习的发生,学习并不保证行为的改变,而改变了的行为也不会自动产生业务成果。每一层都比前一层更难、更昂贵地去测量,这也是为什么如此多的项目止步于第一层。然而,真正的价值恰恰存在于更高的层级之中。

该模型一种常见的完善做法是逆向规划。与其从第一层开始并寄望于这条链条能够维系,不如先定义你想要的第四层成果,然后逆向推导出能够产生它的工作岗位行为、使这些行为得以实现所需的学习,以及最后让培训本身能够扎根的种种条件。逆向设计使每一层都始终对准一项真实的业务需求,而不是对准虚荣指标。它还能帮助你避开那个经典的陷阱:一边庆祝亮眼的满意度分数,一边培训本应改进的工作流程却毫无改变。

在我们深入每一层之前,还有一个想法值得强调。评估不仅仅是事后证明价值。它同时也是一门设计的功夫。事先决定你将如何衡量成功,会迫使你准确地表述培训应当改变什么,而这几乎总能让培训本身更加清晰、更加聚焦。

第一层:反应

第一层捕捉参与者对培训的即时反应。他们是否觉得它切题、引人投入、讲授得当?这通常通过一份简短的课后调查来测量,有时被称作"微笑表",在项目一结束就填写。

有用的第一层问题会超越满意度本身。要询问内容是否与参与者的岗位相关、他们是否有信心加以应用,以及他们是否会向同事推荐这次培训。关于信心和相关性的问题尤其具有预测性,因为一场感觉不切题的培训,无论多么令人愉快,都很少会改变行为。

现代实践区分了反应的几种不同面向。满意度问的是人们是否喜欢这堂课。相关性问的是内容是否与他们的实际工作相连接。投入度问的是他们是否积极参与,而不是被动地坐着看幻灯片。在这些当中,相关性和应用意向对后续行为改变的预测,往往远胜于单纯的满意度,因此要把你的第一层问题向它们倾斜。诸如"我打算在下个月内应用我所学到的东西"这样的问题捕捉到了意向,而意向正是通往真正行为改变那条链条的第一环。

把第一层当作一种诊断,而不是一张用来庆祝的成绩单。如果反应分数偏低,你就得到了一个早期预警,表明更高的层级不太可能带来成效,你便可以在投入昂贵的后续测量之前先行调查。如果分数偏高,你只是越过了第一道门槛,却尚未证明是否真的学到或应用了任何东西。

让第一层调查保持简短,并在印象仍然新鲜时立即进行。一份为培训后反馈而调整过的简单调查模板在这里就很好用。请记住,高满意度本身证明不了多少。人们可以热爱一门课程却什么也没学到,因此要把第一层视为必要,却远非充分。

第二层:学习

第二层衡量在知识、技能或信心上的实际增益。最干净的做法是前测与后测:在培训前测试参与者,培训后再测一次,然后加以比较。两者之差把培训所增添的东西,从人们本已知道的东西中剥离出来。

评估可以有多种形式,包括测验、实操演示、基于情境的问题,或自评的信心量表。对于知识密集的主题,客观测验效果最好。对于技能,一次按评分细则打分的演示或角色扮演更为有效。关键原则是对照培训所设计要达成的具体学习目标来进行测量。

第二层告诉你学习是否在课堂里发生了,但它无法告诉你这种学习是否能在与日常工作的接触中存活下来。要弄清这一点,你需要第三层。

第三层:行为

第三层是许多项目证明其价值、或暴露其失败之处。它追问参与者一旦回到岗位,是否真的应用了所学。由于行为的改变需要时间,第三层评估发生在培训之后的数周或数月,而非当即进行。

常见的方法包括向学员及其管理者发送跟进调查、在岗观察,以及查看与所训技能相关的绩效指标。向管理者发送的调查尤为有力,因为管理者能看到新的行为是否得以延续。要提出具体、可观察的问题:"自培训以来,这个人应用这项新技巧的频率有多高?"

第三层还会让障碍浮出水面。如果人们学会了材料却没有在使用,问题也许出在缺乏时间、工具或管理层的支持,而不是培训本身糟糕。这一发现很有价值,因为它告诉你解决之道在于工作环境,而非课程内容。把简短的跟进脉搏调查嵌入你更广泛的员工敬业度调查项目之中,是随时间追踪行为改变的一种高效方式。

第四层:成果

第四层把培训与组织成果联系起来,比如生产率、质量、客户满意度、留存或销售额。这是高管最关心的层级,也是最难测量的层级,因为除培训之外还有许多因素在影响业务结果。

难点在于归因。如果在一次销售培训项目之后销售额上升了,这究竟是培训、一款新产品、一个季节性趋势,还是三者兼有?稳健的第四层评估会运用对照组、基线和趋势数据,来构建一个可信、尽管很少完美的论证。与其径直宣称培训导致了某个结果,不如把它表述为一个由贯穿四个层级的证据所支撑的促成因素。

并非每个项目都需要第四层测量。把这份繁重的工作留给那些高成本、高风险的举措,那里证明影响才配得上所付出的努力。

在实践中运用该模型

一种务实的做法是有选择地运用各个层级。对一切都做第一层,因为它很便宜。为任何有清晰学习目标的项目加上第二层。把要求更高的第三层和第四层留给你最重要或最昂贵的举措,在那里证明影响才至关重要。

在培训开始之前而非之后规划评估。知道你将如何衡量成功,会厘清培训应当达成什么,以及在每一层要提出哪些问题。可复用的调查模板让你的工具在各项目之间保持一致,从而使你能随时间比较不同批次。浏览人力资源调查模板库,以标准化你的培训后调查和跟进调查。像SaaS 初创公司这样快速扩张的团队,往往需要快速地入职和提升技能,会从一种轻量却一致、并随其一同成长的评估习惯中获益。

常见问题

我需要为每一次培训都测量全部四个层级吗?不需要。第一层很便宜,值得作为惯例去做。更高的层级成本更高,因此要把它们留给那些证明影响值得付出努力的重要或昂贵项目。

我应该在何时发送第三层的行为调查?通常在培训之后的四到十二周,等参与者已经有了应用所学的真实机会之后。发送得太早,测量到的是意向,而不是实际的行为改变。

我该如何在第四层证明培训的投资回报率?真正的投资回报率很难衡量,因为有许多因素影响业务结果。运用基线、对照组和趋势数据来构建一个可信的论证,并把培训表述为一个促成因素,而非唯一的原因。

柯克帕特里克模型过时了吗?它多年来经过完善,至今仍被广泛使用。批评者指出它可能暗示一条严格的线性链条,因此现代实践往往强调从期望的成果出发逆向规划评估,而不是把这些层级当作一个僵硬的序列。

满怀信心地衡量你的培训影响。在几分钟内构建反应、学习和跟进调查。创建免费账户,或探索我们的调查模板即可开始。

热门帖子

SurveyMaker.io

借助 AI 在几分钟内创建专业的问卷、测验和表单。

开始
Build your first survey with AI — free No credit card · ready in seconds Get started