性格测验哪个有科学根据?MBTI、九型、DISC、依附型态诚实排一次
你做过 MBTI,也许还做过九型、DISC,或者测过自己的依附型态。
每一个测完都觉得「有点准」。但如果有人问你:这些东西到底有没有科学根据?你大概答不上来。
这篇把常见的几套摊开来诚实讲。我们自己站上这几套都有,所以下面每一句都会让我们自己不好看一点 · 但这件事本来就该有人讲清楚。
先讲判准:什么叫「有科学根据」
不是「有没有人研究过」,是三件事:
一、再测一次还准吗(信度)· 同一个人隔几周再测,结果应该差不多。
二、它测到的是它说的那个东西吗(效度)· 说是测外向,测出来的就该是外向。
三、能不能预测现实 · 分数高的人,在真实生活里是不是真的不一样。
三件都过得了,才算站得住。下面就照这个排。
五大人格(Big Five)· 学界的标准答案
这是心理学界目前真正在用的那一套。它从几十年的因素分析研究里长出来,跨文化重复验证过,对工作表现这类外部指标有公认的预测效度(Barrick & Mount, 1991)。
但我要立刻补一句:它的效果量是中等的。
而且它跟其他测验有同一个限制:分数来自你自己回答,测到的是「你怎么描述自己」,会受自我认知、社会期许、甚至当下心情影响。
依附型态 · 学术基础最扎实的那一套
这一套跟后面几套不在同一个层级。
它是心理学正规研究的产物:鲍比(John Bowlby)从 1960 年代提出依恋理论,安斯沃斯(Mary Ainsworth)1970 年代用「陌生情境」实验做出可观察的分类,六十年来累积了大量同侪审查文献,是发展心理学与社会心理学的核心理论之一。
而且那个实验的设计本身就很漂亮 · 让一岁左右的婴儿与母亲短暂分离再重聚,观察的重点不是分离时哭得多惨:
这句话放到成人关系里一样成立。你吵架时多生气不是重点,重点是和好那一刻,你回得来吗。
MBTI · 好用,但科学上有明显弱点
三个被反复指出的问题:
再测信度不高 · 隔几周重测,相当比例的人会得到不同的四字母。原因是它把连续的分数硬切成二分类别,落在中间的人一点误差就会跳到另一边。
缺一个维度 · 它没有情绪稳定度(神经质)这一整块,而那是 Big Five 里预测力很强的一项。
学界不用它做研究 · 论文里用的是 Big Five。
但这不代表它没用。当作认识自己、跟人对话的语言,它好懂好记能引发共鸣;不要拿它做有后果的决策(招聘、诊断、判定一段关系),那些场合该用更严谨的工具。
九型人格 · 观察系统,不是实证结论
九型是实务界磨出来的观察传统,累积了很细致的人性洞察,但它的实证支持有限。已有系统性回顾与效度研究检视过它(Hook et al., 2021;Newgent et al., 2004)。
🔴 更要注意的是次级概念:侧翼、整合线与解离线这些说法,几乎没有研究支持。它们是经验传统,不是实证结论。
这不是说它们没价值 · 侧翼是很好用的观察角度。但它跟「有研究证明」是两件事,讲的人应该标清楚。
DISC · 一九二八年的行为模型
DISC 的源头是 Marston 在 1928 年提出的四型行为模型。那是一个公开的学术理论,但它在心理计量上的表现,比五大人格弱得多。
它的长处在于好上手、在团队沟通的场景里很实用。它的短处是:它描述的是行为风格,不是稳定的人格结构。
诚实排一次
如果只用「科学根据」这一把尺:
学术基础扎实 · 五大人格、依附理论
好用但有明显科学弱点 · MBTI
观察系统,实证支持有限 · 九型、DISC
那该怎么选
看你要拿它做什么。
要做有后果的决定(招人、转职、判断一段关系要不要继续)· 用站得住的那几套,而且不要单靠一个测验。
要认识自己、要一个能跟人讲的语言 · MBTI、九型都很好用,它们的价值本来就在这里。
要处理关系里反复出现的同一个痛 · 依附型态最直接,因为它本来就是为了解释这件事而生的。
最后一句
所有这些测验,包括最严谨的那几套,测到的都是你怎么描述自己。
它们像镜子。镜子的品质有差,但照出来的都是你,而且镜子不会替你决定要走哪条路。
常见问题
五大人格(Big Five)与依附理论。五大人格从几十年的因素分析研究长出来,跨文化重复验证,对工作表现等外部指标有公认的预测效度;依附理论是心理学正规研究的产物,六十年来累积大量同侪审查文献,是发展心理学的核心理论之一。MBTI 好用但有明显科学弱点,九型与 DISC 是实务界的观察系统,实证支持有限。
它是实务界磨出来的观察传统,累积了细致的人性洞察,但实证支持有限,已有系统性回顾与效度研究检视过(Hook et al., 2021;Newgent et al., 2004)。特别要注意的是侧翼、整合线与解离线这些次级概念,几乎没有研究支持·它们是经验传统,不是实证结论。这不代表没价值,但跟「有研究证明」是两件事。
DISC 源自 Marston 在 1928 年提出的四型行为模型,是公开的学术理论,但在心理计量上的表现比五大人格弱得多。它的长处是好上手、在团队沟通场景实用;短处是它描述的是行为风格,不是稳定的人格结构。拿它做团队沟通的共同语言很好,拿它做有后果的决策就不够。
三个原因:一、MBTI 再测信度不高,隔几周重测相当比例的人会换型,因为它把连续分数硬切成二分类别;二、它缺少情绪稳定度(神经质)这一整个维度,而那是 Big Five 里预测力很强的一项;三、Big Five 用连续分数,跨文化重复验证过,对现实结果有公认的预测力。
安斯沃斯(Mary Ainsworth)1970 年代的「陌生情境」实验:在实验室里让一岁左右的婴儿与母亲短暂分离再重聚,观察婴儿的反应。这个设计最关键的地方是·真正的讯息不在分离时哭得多惨,而在重聚那一刻孩子能不能被安抚。这个观察后来被延伸到成人关系研究上。
不是。排名不等于哪个对你有用·一把测得很准的尺,如果量的不是你想知道的东西,还是没用。判准是你要拿它做什么:要做有后果的决定(招人、转职、判断关系),用站得住的那几套而且不要单靠一个测验;要认识自己、要一个能跟人沟通的语言,MBTI 与九型的价值本来就在这里。