性格测验哪个有科学根据?MBTI、九型、DISC、依附型态诚实排一次|馥灵之钥
人格测验

性格测验哪个有科学根据?MBTI、九型、DISC、依附型态诚实排一次

作者:王逸君(馥灵之钥创办人)|2026.09.02

你做过 MBTI,也许还做过九型、DISC,或者测过自己的依附型态。

每一个测完都觉得「有点准」。但如果有人问你:这些东西到底有没有科学根据?你大概答不上来。

这篇把常见的几套摊开来诚实讲。我们自己站上这几套都有,所以下面每一句都会让我们自己不好看一点 · 但这件事本来就该有人讲清楚。

先讲判准:什么叫「有科学根据」

不是「有没有人研究过」,是三件事:

一、再测一次还准吗(信度)· 同一个人隔几周再测,结果应该差不多。

二、它测到的是它说的那个东西吗(效度)· 说是测外向,测出来的就该是外向。

三、能不能预测现实 · 分数高的人,在真实生活里是不是真的不一样。

三件都过得了,才算站得住。下面就照这个排。

五大人格(Big Five)· 学界的标准答案

这是心理学界目前真正在用的那一套。它从几十年的因素分析研究里长出来,跨文化重复验证过,对工作表现这类外部指标有公认的预测效度(Barrick & Mount, 1991)。

但我要立刻补一句:它的效果量是中等的。

有预测力,不等于能算命。这个分寸要抓住。

而且它跟其他测验有同一个限制:分数来自你自己回答,测到的是「你怎么描述自己」,会受自我认知、社会期许、甚至当下心情影响。

依附型态 · 学术基础最扎实的那一套

这一套跟后面几套不在同一个层级。

它是心理学正规研究的产物:鲍比(John Bowlby)从 1960 年代提出依恋理论,安斯沃斯(Mary Ainsworth)1970 年代用「陌生情境」实验做出可观察的分类,六十年来累积了大量同侪审查文献,是发展心理学与社会心理学的核心理论之一。

而且那个实验的设计本身就很漂亮 · 让一岁左右的婴儿与母亲短暂分离再重聚,观察的重点不是分离时哭得多惨:

真正的讯息在重聚那一刻,孩子能不能被安抚。

这句话放到成人关系里一样成立。你吵架时多生气不是重点,重点是和好那一刻,你回得来吗。

MBTI · 好用,但科学上有明显弱点

三个被反复指出的问题:

再测信度不高 · 隔几周重测,相当比例的人会得到不同的四字母。原因是它把连续的分数硬切成二分类别,落在中间的人一点误差就会跳到另一边。

缺一个维度 · 它没有情绪稳定度(神经质)这一整块,而那是 Big Five 里预测力很强的一项。

学界不用它做研究 · 论文里用的是 Big Five。

但这不代表它没用。当作认识自己、跟人对话的语言,它好懂好记能引发共鸣;不要拿它做有后果的决策(招聘、诊断、判定一段关系),那些场合该用更严谨的工具。

九型人格 · 观察系统,不是实证结论

九型是实务界磨出来的观察传统,累积了很细致的人性洞察,但它的实证支持有限。已有系统性回顾与效度研究检视过它(Hook et al., 2021;Newgent et al., 2004)。

🔴 更要注意的是次级概念:侧翼、整合线与解离线这些说法,几乎没有研究支持。它们是经验传统,不是实证结论。

这不是说它们没价值 · 侧翼是很好用的观察角度。但它跟「有研究证明」是两件事,讲的人应该标清楚。

DISC · 一九二八年的行为模型

DISC 的源头是 Marston 在 1928 年提出的四型行为模型。那是一个公开的学术理论,但它在心理计量上的表现,比五大人格弱得多

它的长处在于好上手、在团队沟通的场景里很实用。它的短处是:它描述的是行为风格,不是稳定的人格结构。

诚实排一次

如果只用「科学根据」这一把尺:

学术基础扎实 · 五大人格、依附理论

好用但有明显科学弱点 · MBTI

观察系统,实证支持有限 · 九型、DISC

但排名不等于哪个对你有用。一把测得很准的尺,如果量的不是你想知道的东西,还是没用。

那该怎么选

看你要拿它做什么。

要做有后果的决定(招人、转职、判断一段关系要不要继续)· 用站得住的那几套,而且不要单靠一个测验。

要认识自己、要一个能跟人讲的语言 · MBTI、九型都很好用,它们的价值本来就在这里。

要处理关系里反复出现的同一个痛 · 依附型态最直接,因为它本来就是为了解释这件事而生的。

最后一句

所有这些测验,包括最严谨的那几套,测到的都是你怎么描述自己

它们像镜子。镜子的品质有差,但照出来的都是你,而且镜子不会替你决定要走哪条路。

想测依附型态:依附型态测验 · 免费,不用注册。

想测五大人格:五大人格测验

想知道 MBTI 的科学争议完整版:MBTI 到底准不准?是不是伪科学

常见问题

性格测验哪一个最有科学根据?

五大人格(Big Five)与依附理论。五大人格从几十年的因素分析研究长出来,跨文化重复验证,对工作表现等外部指标有公认的预测效度;依附理论是心理学正规研究的产物,六十年来累积大量同侪审查文献,是发展心理学的核心理论之一。MBTI 好用但有明显科学弱点,九型与 DISC 是实务界的观察系统,实证支持有限。

九型人格有科学根据吗?

它是实务界磨出来的观察传统,累积了细致的人性洞察,但实证支持有限,已有系统性回顾与效度研究检视过(Hook et al., 2021;Newgent et al., 2004)。特别要注意的是侧翼、整合线与解离线这些次级概念,几乎没有研究支持·它们是经验传统,不是实证结论。这不代表没价值,但跟「有研究证明」是两件事。

DISC 测验准吗?

DISC 源自 Marston 在 1928 年提出的四型行为模型,是公开的学术理论,但在心理计量上的表现比五大人格弱得多。它的长处是好上手、在团队沟通场景实用;短处是它描述的是行为风格,不是稳定的人格结构。拿它做团队沟通的共同语言很好,拿它做有后果的决策就不够。

为什么学界用 Big Five 不用 MBTI?

三个原因:一、MBTI 再测信度不高,隔几周重测相当比例的人会换型,因为它把连续分数硬切成二分类别;二、它缺少情绪稳定度(神经质)这一整个维度,而那是 Big Five 里预测力很强的一项;三、Big Five 用连续分数,跨文化重复验证过,对现实结果有公认的预测力。

依附型态的实验是怎么做的?

安斯沃斯(Mary Ainsworth)1970 年代的「陌生情境」实验:在实验室里让一岁左右的婴儿与母亲短暂分离再重聚,观察婴儿的反应。这个设计最关键的地方是·真正的讯息不在分离时哭得多惨,而在重聚那一刻孩子能不能被安抚。这个观察后来被延伸到成人关系研究上。

科学根据比较弱的测验,是不是就不该做?

不是。排名不等于哪个对你有用·一把测得很准的尺,如果量的不是你想知道的东西,还是没用。判准是你要拿它做什么:要做有后果的决定(招人、转职、判断关系),用站得住的那几套而且不要单靠一个测验;要认识自己、要一个能跟人沟通的语言,MBTI 与九型的价值本来就在这里。