
一套量表在上个项目里用得顺利,换一批人、换一种服务,还能直接沿用吗?要先重新看它准备回答什么问题。量表名称没有变化,不代表结果的解释和用途也能原样搬过去。对持续开展测评的机构来说,这一步决定了“沿用经验”是否真的省事。
先看这次准备依据结果做什么
设想三个不同场景:学校想了解学生需要哪些支持,咨询人员希望为初次会谈补充信息,服务团队准备观察一段时间后的变化。即使都涉及情绪或压力,三次测评需要提供的信息也未必相同。这是说明思路的假设情境,并非真实项目案例。
第一次可能更关注群体中有哪些需要进一步了解的问题,第二次需要把结果放进个人经历中讨论,第三次则要考虑前后结果是否适合比较。若先复制原来的测评组合,再临时决定如何解释,就容易让工具反过来决定服务内容。
适用人群和结果用途,需要一起核对
国际测验委员会的测验使用指南强调,选择工具要考虑使用目的、相关人员与施测情境,并查看是否有支持相应用途的证据。落实到日常工作,可以问得很具体:这批参与者是否符合适用范围?题目表达能否理解?准备根据结果作出的判断,有没有相应依据?
《教育与心理测验标准》对效度的讨论,同样把重点放在分数的解释和拟定用途上。一项工具可以提供某方面的信息,并不自动支持所有与它看似相关的判断。例如,用来理解近期困扰的结果,不能不加说明地转成对一个人长期能力的评价。

机构保存常用量表时,可以同时保留简短的使用说明:适合回答的问题、适用对象、所用版本,以及报告解释时要注意什么。下次换场景,先核对这些信息,比只看量表名称更容易发现需要调整的地方。
资源丰富时,更需要选用理由
量表库较丰富,给机构留下了更多选择空间。以橙星云目前拥有的上百种心理测评量表为例,资源数量提供了查找候选工具的基础,实际安排仍需要回到本次服务的问题。工具越多,越值得把“为什么选这一项”说清楚。
一个实用办法,是在项目准备材料里给每项工具写一句选用理由。例如:“用于了解本次会谈需要进一步讨论的困扰”,然后核对工具是否确实支持这一用途。若理由写不清楚,先暂停添加量表,往往比让参与者多做一份更有帮助。
也要给施测留出明确安排。参与者什么时候完成、是否理解说明、工作人员怎样处理疑问,都可能影响资料的可解释性。换了服务场景,即便工具不变,这些实施条件也值得重新检查。
复测时,把变化放回具体条件
后续复测容易出现另一种照搬:看到分数降低,就直接写成服务有效。结果变化需要结合测评间隔、工具版本、参与情况和生活情境理解;只有一部分人完成复测时,也不能把这部分人的变化直接当作整个群体的变化。

准备复测前,可以先写清楚想观察的问题,保留前后可比较的条件,再把分数与必要的访谈、观察放在一起看。值得延续的是有依据的工作方法,而每一次具体使用,都需要重新回答:这份结果能够说明什么,我们打算怎样用它。
参考资料
国际测验委员会:The ITC Guidelines on Test Use
AERA、APA、NCME:Standards for Educational and Psychological Testing(2014),效度章节
