
朋友发来一张十四维结果图,你找了个同名测试,答完却发现题数不同,连“主罪”“主德”也换了。再仔细看,傲慢和谦逊居然都不低:这是答矛盾了,还是测试算错了?
先别急着重测。网上同名的七宗罪七美德测试,可能来自不同提供者,题目和计分方式并不相同。两侧能否同时高,也要看它们是分别计分,还是被设计成同一个分数的两端。找到版本说明,比照着截图猜自己是哪类人更有用。
35题、42题、56题,先认清自己打开的是哪一版
下面是截至2026年10月11日核对到的公开页面说明。我们没有代替读者作答,也没有验证后台计分代码;这张表用于辨认版本,不是准确度排名。
| 页面提供者 | 公开题量与维度 | 页面说明的结果形式 | 选版本时还要注意什么 |
|---|---|---|---|
| Baozang Tools | 35题、14维;包括28道五点评分题和7道二选一情境题 | 各维为0—100的相对分值 | 这里核对的是英文介绍页;不能仅凭“镜像配对”的说法认定两项分数互补 |
| humanbenchmark.cn | 42题、14维;页面称每维3题 | 维度分数,以及两组各自最突出的“主罪”“主德” | 公开说明包含反向计分;本次所读说明未明确给出分值范围 |
| NeuroXYZ | 56题、14维;每维4题 | 0—10分轮廓,标注为v0.1娱乐版 | 明确说明各维分别计分,不互相相减 |
题数较多,并不能单凭这一点判断更准。你若是想和朋友讨论同一张图,先对齐提供者、具体页面和版本;若只是想做一次趣味自我探索,可以优先选题目说明、计分规则和使用边界写得清楚的版本。
还要留意介绍页自身是否一致。例如,TestWhat的一页对照说明页首标注56题,常见问题却写七宗罪35题、七美德28题。本次没有确认它们对应什么更新关系,因此不能替读者认定最终题量。碰到这种情况,先查看实际作答页的题数与说明,无法核实就保留疑问。
两侧都高,要先分清是哪一种“高”
第一种情况是:结果同时给你一个“主罪”和一个“主德”。这可能只是分别从两组中选出最高项。比如42题页面说明的就是组内比较;有两个最高项,并不自动意味着它们的绝对分数都高,更不代表都高于多数人。
第二种情况是:同一组对应词的数值确实都靠近各自量尺上端,例如傲慢和谦逊双高。此时需要查看两个分数是否独立计算。
以表中的NeuroXYZ版本为例,它明示十四个维度分别计分。对应词在图上位置相对,不等于它们必须一升一降。在这个设计下,两项同时高在计分逻辑上可以成立;但仅凭双高,也不能推出你正在“内心交战”,或必然把一种冲动压抑得很辛苦。
可以用一个虚构场景理解:一个人做熟悉的项目时,很在意自己的判断获得认可;遇到不熟悉的工作,又愿意承认知识有限、向别人请教。如果不同题目分别触及这些情境,他可能对两侧的一些描述都表示认同。这个例子只是帮助理解分别提问、分别计分的可能性,不能替代该测试的实际题意,也不能替任何人的结果定原因。
对于其他版本,不要照搬这一解释。“对立”“对位”“镜像”等文字可能只是在介绍概念关系,并没有公开数学上的计分关系。只有规则明确,两项分数为何能同时高才有判断依据。
反向题,也不等于把“罪”换算成“德”
有些页面提到反向计分,很容易让人误以为:“我越不同意傲慢,谦逊就一定越高。”
这是两个不同问题。反向计分涉及某道题的回答怎样进入相应维度;两个维度是否互补,则涉及整套测试如何定义和计算它们。35题和42题的页面都提到反向计分,但这句话本身不足以证明某个美德分数等于总分减去对应的七宗罪分数。
作答时按当前页面要求的时间范围和具体情境回答即可。刻意猜哪一项能让结果更好看,反而会让你更难用这次回答回想自己的真实经历。
换一个版本,分数就别接着比较了
假设你在一个版本里拿到“耐心8分”,另一个版本里拿到“耐心60分”。即使把8分乘以10,也不能直接说自己从80降到了60。
不同版本可能使用不同题目、时间范围、选项和权重;同名维度的含义也未必完全相同。统一显示成百分制,只是统一了表面单位,没有建立两套分数之间可比较的依据。
想保留结果,可以顺手记下这几项:
- 提供者、页面链接、作答日期和版本号
- 实际题数、维度名称、分值范围
- 要求回想的时间段,例如近期或过去六个月
- 是否说明各维独立、反向计分或结果排序方式
- 当时最拿不准的一道描述对应什么生活情境,不必抄存整份题目
即使一直用同一版,也先把前后差异当作值得回看的线索。没有可靠性、常模及变化解释的证据时,不能给几分的变化冠上“明显进步”或“人格恶化”的结论。
最后,把一个标签换成一件具体的事
如果“傲慢和谦逊都高”让你很困惑,可以暂时放下两个词,回想最近一次意见不合:当时你在维护什么?别人提出证据后,你有没有改变判断?你承认不知道,是因为真的不熟悉,还是担心被评价?
这些问题不需要合计分数,也没有及格线。它们的作用是让一个笼统标签落到能够讨论的经历上。
以上版本的公开说明将用途限定于娱乐、自我探索或非诊断性观察。页面提到参考某种心理量表,也不足以说明改编后的题目继承了原量表的研究证据。用它开启一次有趣的讨论可以;据此评判谁更善良、谁更危险,或替自己作临床判断,都超出了这类结果能够支持的范围。
