Library · 卷三 研究

九型人格是伪科学吗?实证研究综述与大五人格对照表

卷三 · 研究Anna Sutton, Ph.D.(原著)|易境(译)

本文为安娜·萨顿(Anna Sutton)博士对九型人格研究的综述,梳理已发表的问卷研究、效标测量、型别稳定性与工作应用等实证成果,并以表格汇总九型各型在「大五」人格特质上的典型得分。

文章基本信息

《「这是真的吗?」——九型人格研究综述》("But Is It Real?" A Review of Research on the Enneagram),作者 Anna Sutton(安娜·萨顿),博士。原载《九型人格期刊》(The Enneagram Journal)2012 年 7 月号,第 5–19 页;版权归国际九型人格协会(International Enneagram Association)所有。

译者说明:本文系该篇研究综述的全文中译。原文含 1 张表格(第 17 页「九型各型在『大五』上的得分摘要」),已完整译制为中文表格,并保留原表的符号规则(大写/小写、「?」的含义);原文无插图。参考文献按原文逐条保留英文,以便查证与检索。文中人名、机构名首次出现时以「中文(English)」标注,其后使用中文名。术语约定:Enneagram 译为「九型(人格)」,type 译为「型」,reliability 译为「信度」,validity 译为「效度」,criterion measure 译为「效标测量」,Big Five 译为「大五(人格)」,wings 译为「侧翼」,self-report 译为「自评」,implicit motives 译为「内隐动机」,integration / disintegration 译为「整合/解离」;RHETI、WEPSS、OPQ、MBTI 等量表缩写按原文保留。

「这是真的吗?」——九型人格研究综述

安娜·萨顿(Anna Sutton),博士

在我向人们介绍九型人格时,最常被问到的一个问题大致是这样的:「没错,可它是真的吗?有什么科学证据?」几年前,正是这个问题促使我着手博士研究。我能看到九型对我本人有效,但我想知道,它能否经受住严谨的心理学研究的检验。在本文中,我尝试梳理已发表的九型人格研究,以便下次有人再问你那个问题时,你能自信地回答:「有的,已有充分的效度证据,让我讲给你听……」

为什么要研究九型人格?

我们的九型知识,大多是通过叙事与经验累积起来的。小组访谈、满是语录与故事的书、视频影像——任何借助他人经验中的例子来让各型鲜活起来的方式——都是我们大多数人了解九型的途径。我们对九种类型有着深刻而丰富的理解与描述。那么,为什么还要做研究呢?

我认为扎实的研究至关重要,原因有二。第一,它有助于为我们使用九型提供依据。遗憾的是,市面上充斥着大量的时髦与风潮,在自我认识与自我发展领域尤甚:网上的「人格测试」能告诉你自己像哪种动物,一些旨在改善生活的书,其依据不过是对某个人有效的轶事。轶事在激起兴趣方面固然不错,但作为专业的九型从业者,我们的部分职责正是要证明:九型并非又一个时髦玩意,我们用来充实各型的故事与经验,不只是顺手好用,而是人与人之间异同的真实写照。唯有通过结构良好、严谨求实的研究,我们才能累积起这一证据基础,并确立九型为一套可靠且有效的人格与发展模型。

拥有优质研究的第二个理由,是要敲响一记警钟:切莫让九型的真实面貌,湮没在个人化的诠释或臆测之中。我们从九型(事实上也从大量心理学研究)中得知的一件事是:我们每个人看世界的方式都略有不同,且倾向于让所见之物「迁就」我们的期待或欲求。这一点并不会因为我们在学习或使用九型就停止发生。我们可能觉得某个关于某型的故事特别击中自己,可我们又如何知道它真能代表那一型,而不只是某个人的怪癖?若没有优质的研究来辨识与界定各型,我们就很容易依据自己独有的知觉,对各型妄下论断。

研究是一种方式,能让不同的从业者围绕九型的根基凝聚在一起——当然是在增进我们的理解,但更是在共同的地基之上加以增筑,从而使我们的知识得以共享,而非四分五裂。

我认为,究其根本,研究不过就是常识罢了。在把一个特别引人入胜的故事用作例证之前,我们当然想核实它对那一型的其他人是否也同样成立;我们当然想确保,没有在「如何理解自己与他人」这件事上误导他人。重视研究与重视我们实践中的真实性,并无二致。它是一段发现之旅:发现新事物,并检验我们自以为已知的事物。

什么才算「好的」人格理论?

那么在这段发现之旅上,我们究竟想弄清什么?若要证明九型是一套「真正的」人格模型,我们需要考察哪些方面?在我本人的研究(Sutton, 2007)中,我发现人格心理学领域的研究者与理论家在评估人格理论时,力图回应三条主要标准。第一条,是人格理论必须科学严谨,也就是说,理论要能作出清晰、可检验的预测。说一套理论必须能被证伪才算「好」,听起来或许奇怪。但如果一套理论含糊到任何我们能想象的东西都能塞进去,它实际上就毫无用处。一套说「物体有时会落向地面、有时不会」的引力理论是无法检验的:若我们松手放下一块石头而它飘了起来,也并不能证伪这套理论。这对人格理论来说可能是个大问题,因为我们处理的对象太过复杂——人心——于是很容易说一句「我们有时这样、有时不这样」就了事。一套科学严谨的理论不会假装复杂之事很简单,但它会对那些复杂之事作出清晰、可检验的预测。九型中就有这样一个例子:它一边清晰地描述各型,一边描述各型在安全或压力之时如何变化。如果我们说第七型通常乐观开朗,但在压力下会变得更挑剔、更悲观,这就是从理论中导出的一个具体、可检验的预测。

评判人格理论的第二条标准,是它的有用性。正如最早的应用心理学家之一库尔特·勒温(Kurt Lewin)所说:「没有什么比一套好的理论更实用。」尤其在我本人所在的工作心理学领域,人们渴望的是有用的理论,而非无法用于改善日常生活、流于抽象的表述。只要看看九型相关书籍与课程的层出不穷,就能看到它被应用的种种不同方式。要证明一套理论的实用价值,研究必须检验这些主张。譬如,与其仅仅声称学习九型能帮助团队更好地协作,我们必须证明它确实有效,并能明确指出它究竟是如何做到的。人们究竟怎样协作得更好了?自他们学习九型以来,哪些方面有所改善?

最后一条,是对一套综合理论的追求——一套能够囊括研究者迄今在该领域所发现的一切的理论。这是人格心理学对「万有理论」的向往,而它要覆盖的范围极广,因为它需要能够描述:我们每一个人如何与地球上的其他每个人既相似又不同、我们如何成为现在这样、以及我们未来可能是什么样子。这里我们就撞上了一个难题。要考察人与人之间的差异,就必须采取「广」的路数,着眼于众多人的平均值,以便判断他们与其他人相比或大或小的差异,却会忽视个体;另一方面,要细致地理解个体,理解其个人历史与成长,又需要「深」的路数,对个体案例作详细分析,却会牺牲可推广性。我相信,九型能够提供一条整合二者的途径。九型类型学既描述了同一型的人如何共享某种人格的内在结构,也描述了它们如何不同于他人。研究有助于表明:九型对每个人都适用,同时它也能告诉我们关于个体的细致信息。

因此,一套「好的」人格理论,应当是可科学检验的、有用的、且综合全面的。我初见九型时为之兴奋、至今依然如此,原因就在于我相信它满足这些标准,其程度不亚于、甚至优于我所接触过的任何其他人格模型。然而,这份信念,以及对九型可能有多好的种种理论阐释,都还不够。我们需要研究来加以支撑。

迄今我们了解到什么?

多数九型作者倾向于把精力放在「九型如何帮助我们成长」上,而非去做检验模型本身的研究。虽然人们对发表九型的理论文章抱有一定兴趣,但对模型进行科学严谨检验的兴趣则相对较少。与此相伴的还有一个不幸的事实:许多心理学家对九型仍抱有令人失望的偏见,这很可能限制了好研究的发表。这就意味着,可供综述的研究论文与同行评审论文,数量相对有限。不过,就我们目前所拥有的而言,已足以为九型的研究基础开出一个有趣而有说服力的头。

理论性文献

已有若干理论文章试图拓展九型可能的应用。例如在商业领域,卡特与库兹明(Cutting & Kouzmin, 2004)在一篇论述密集的理论文章中,提出了一套关于知识获取与意义建构的新框架,把九型纳入其中,主张将九型用作一个整体模型的一部分,用以在社会科学中开发并整合知识。一篇关于市场细分的文章(Kamineni, 2005)建议运用九型类型学,针对作为消费者的各型,设计不同的营销策略。关于提升职场灵性(workplace spirituality)的建议(Kale & Shrivastava, 2003)则推荐把九型引入组织,作为公司营造更和谐、更盈利之企业的一条途径。而布鲁加(Brugha, 1998)在一项用于分析管理中的发展决策的体系构想中,也纳入了九型。然而,这些文章全都聚焦于理论发展或应用;它们虽指出了未来研究的有趣方向,却并未开展研究去检验这些建议。

同样,在咨询文献中,怀曼(Wyman, 1998)提出了一套面向咨询从业者的心理治疗模型,把 MBTI 与九型结合起来,认为前者捕捉的是「核心自我」,后者描述的是一个人典型的防御系统。既然九型各型本就已经以「核心自我」来加以描述,那么在缺乏支持性证据的情况下,要无视这些描述、转而偏好迈尔斯-布里格斯类型,就很难说得过去——而遗憾的是,该文并未提供这样的证据。纳兰霍(Naranjo, 1994)也曾讨论九型与其他人格心理模型之间的理论关联,将其与诸如人际环状模型(interpersonal circumplex)以及 DSM-IV 的精神疾病分类相类比。同样,尽管他的理论阐述细致、听上去也合乎道理,却同样尚未经过检验。

现在我们转向考察过去数十年间已开展的九型实证研究。尽管我此处的焦点是广义上的心理学中的九型,但值得一提的是,已发表的研究覆盖了从宗教哲学到教育学的一系列领域。

九型问卷研究

与许多人格研究一脉相承,若干研究把重点放在构建一份可靠、能识别 9 种类型的问卷上。其中一些问卷研究,其目标还在于论证九型理论本身的信度或效度,而不只是论证所考察的那份特定问卷。当然,要把「对理论的检验」与「对工具的检验」截然分开是困难的,但这是人格研究中普遍存在的问题——在这里,对某个概念的测量,可能变成该概念本身的替身。

当我们构建一种心理测量工具时,主要有两点关切。第一,测量工具必须可靠:就像我们在两个不同场合量一个人的身高,会期望得到同样的高度,如果一个人在两个不同场合完成同一份问卷,我们也会期望得到同样的结果。第二,问卷应当有效:它应当确实测量到我们声称它在测量的东西。接着用身高的例子来说,一种有效的测量会是以厘米计(而非以千克计)。证明心理概念的有效性比证明物理概念更难,但我们能做到的方法之一是:在若干其他已经确立的人格测量工具上,证明九型各型彼此之间的差异,符合理论上的预期。就身高的例子而言,这就像是在说:我们预期某人在以厘米计时偏矮,那么以英寸计时也会偏矮。事实上,九型各型身上这种符合理论预期、且能区分各型的人格画像,已在若干既有的人格测量工具上得到了展现。

对里索-哈德森九型人格类型指标(RHETI)的初步效度验证,由沃林(Warling, 1995)完成:她从 153 名学生处收集数据,这些学生既完成了 RHETI,也完成了一份既有的问卷——用于测量 16 种人格特质的卡特尔 16PF。她发现 RHETI 各量表与 16PF 上可对应的特质之间存在显著相关,也找到了支持九型各型之间差异的证据。戴迈耶(Dameyer, 2001)对 RHETI 作了进一步研究,证明其重测信度很高:在她的 135 名被试中,有 82% 的人在第二次完成问卷时被识别为同一型。然而,一个人由 RHETI 所识别的型别,与瓦格纳九型人格风格量表(WEPSS)所识别的型别之间,一致性却很弱(仅 42%)。此外,RHETI 与「形容词检核表」(要求被试勾选形容词以描述自己)之间的关系也不强。这表明,这两份九型问卷在描述各型时并不一致——既彼此不一致,也无法被某个外部测量工具清晰地捕捉到。

近年来,在人格研究文献中,大五人格特质(外向性、宜人性、尽责性、情绪稳定性与经验开放性)已成为捕捉人与人之间广泛差异的标准方式。对 RHETI 的进一步研究,以 287 名同时完成 RHETI 与大五测量的被试为样本,显示九型的九个量表总体上与大五呈现出符合理论预期的关系(Newgent 等,2004)。尽管 RHETI 仍有改进余地(其中一些量表的信度不如其他量表),但这提供了一些证据,表明九型各型之间的差异,能够在被视为「行业标准」的人格特质测量上得到展现。

夏普(Sharp, 1994)开展了一项研究,检验另外三份九型问卷(瓦格纳量表、科恩-帕尔默量表与津克尔量表),并将它们与霍兰德职业偏好问卷(Holland Vocational Preference Inventory)相比较,其依据是人格类型会影响一个人偏好的职业环境。他请 340 人完成了全部四份问卷,其分析提供了证据,表明九型问卷具有有效的结构。然而结果显示,由这些问卷所测量的九型型别,与职业偏好之间只有微弱的关系。

总之,虽然已开发出若干九型问卷,它们也能表现出尚可的信度,但要证明效度则更为困难。用一份人格问卷来测量一个人真正的九型型别,当然困难重重。九型之所以在应用中如此有用,部分原因正在于它描述的是我们起初未必能轻易触及的、往往属于无意识的过程与动机。让人完成一份自评问卷,必然会错过这层更深的理解。自评问卷只能触及被试意识层面的自我概念;那些尚未辨识出自身潜意识过程或默认运作方式的人,根本无法准确地就此作答。因此,九型问卷的信度可能会低于测量外显人格的问卷,这本在预料之中。我们固然仍可把问卷用作发现自身型别的初步线索或指导依据,但我认为,用自评问卷去测量从未接触过九型的人,不太可能为整个模型提供有说服力的证据。

可靠的「效标」测量

这就把我们引向了九型研究者不断遭遇的一个难题:缺乏一个标准(效标测量),用以评估各种问卷或判定型别的其他方法的有效性。加马德(Gamard, 1986)的博士研究就聚焦于这一问题:他评估了一组「专家评判者」之间的一致程度——这些评判者观看访谈录像,并被要求判定受访者的型别。然而,加马德把专家评判者所判定的型别,与一个基于他本人和另一位九型从业者共同商定的效标评定相比较。于是,尽管评判者彼此之间表现出高度显著的一致性,他们与效标评定之间的一致性却未高到显著的程度。作者随后把这一结果解读为「未能为专家判断的信度提供证据」,这似乎有些奇怪。更合理的解读或许是:评判者们对型别的判定本身存在共识,只是这共识与研究者的共同判断不同。此外,九型的评判者间一致性,与 DSM-IV 分类(用于精神疾病分类)的评判者间信度研究中所发现的程度相当(Skodol 等,2005),这表明专家评判者能够作出临床有效的判断。不过,加马德的结果也表明,评判者对自己凭直觉给出的被试评级,比实际应有的更为自信——这在评估未来的研究时,是要敲响的一记警钟。

正如思拉舍(Thrasher, 1994)所指出的,加马德的研究所用的专家评判者,虽然对九型非常熟悉,却与参与者素不相识。她提出,熟悉参与者的人(「重要他人」)或许能更好地判定型别;于是她请自己的参与者提名一位重要他人,再向此人提供九种类型的描述,让其判定相应的伴侣属于哪一型。结果或许并不意外:在这 118 对伴侣中,重要他人唯有在本身就已非常熟悉九型系统的情况下,才是合格的型别判定者。

把加马德与思拉舍的结果放在一起看,似乎表明:要让他人作出的判定尽可能准确,途径就是提升判定者既对当事人、又对该系统的熟悉程度。当然,这正是一些周期较长的九型工作坊已经在做的。对自评问卷方法而言,还有一个更麻烦的问题:已有一些迹象表明,我们的九型型别可能会影响我们在其他工具(如 MBTI)上如何报告自己的人格(Wyman & Magidson, 2008)。该研究显示,九型型别与在 MBTI 上对某个偏好项的「误报」,存在显著关系。这就为「人格的不同概念之间如何相互作用」这一有趣领域,开辟了进一步研究的空间。

以自评型别为标准的问卷检验

在辨明了我们在寻找准确效标时面临的一些困难之后,有几种采用「自评或他评型别」作为准确性评判标准的做法值得一提。由丹尼尔斯与普莱斯(Daniels & Price, 2000)开发的「本质九型测试」(The Essential Enneagram test)颇为有趣:相比其他人所采用的传统问卷形式,它使用了一种更偏叙事的路径。受测者不是在回答一系列问题后由计分得出一个可能的九型型别,而是在每一型的一段段描述之间作出选择。这些描述包含关于该型的关键信息(包括世界观与注意力风格),并经过各型代表审阅,以确保其准确性。随后,一个由 970 名尚不知自身型别者组成的大样本完成了该测试。研究者把每个人最初选择的那段描述,与经由型别判定访谈、或在为期 10 周的九型课程后由其本人重新评估所确定的型别相比较,以考察这些段落识别型别的效果。结果发现,受测者最初选择的段落与其最终确定的型别之间,存在统计学上显著的一致性,准确率从第八型段落的 37% 到第九型的 68% 不等。尽管这远高于随机水平(若纯属巧合,我们只能指望九次里对一次,即 11%),但显然仍不完美,该测试更多地被呈现为自我发现的第一步,而非判定型别的确定手段。与此相应,作者还分析了选择某一段落的人,最终被判定为其余八型中每一型的可能性。这一分析在他们书中得到展开,通过描述那些相互关联或「看起来相似」的型别之间的异同,帮助受测者更准确地辨识自己的型别。

同样,瓦格纳九型人格风格量表(WEPPS)历经多年开发,试图借助一份自评量表帮助人们找到自己的型别。WEPPS 包含的题目,既测量 9 种类型中每一型的「资源充沛」(积极或适应性)方面与「资源匮乏」(消极或非适应性)方面(Wagner, 1999)。完成后,受测者会得到每一型与自己相似程度的分数(其中最高者称为核心风格),以及一项衡量他们对该型「资源充沛」与「资源匮乏」两方面认同程度的指标。该测试的心理测量学特性在一个 1,429 人的大样本上得到评估,显示出良好的信度,与其他人格问卷相当。效度则通过以下方式得到论证:一是显示 WEPPS 与其他测量(如冲突处理方式)之间存在符合理论预期的关系,二是发现 WEPPS 的得分与自我判定的型别之间高度一致。若假定受测者的核心风格准确地代表了其九型型别(这些结果表明这是一个合理的假定),我们便能从这个大样本中得出一些有趣的观察。第一,第九型的人数比其他各型大约多出 5%。第二,某些型别存在性别差异:女性比男性更可能是第二型、第四型或第七型,而第三型、第五型与第八型则相反。

尽管这些研究主要着眼于开发可靠且有效的问卷,它们也向我们展示了:使用一个好的效标测量,如何能推进我们对九型的理解与应用。我们由此可以开始辨识各型之间常见的混淆,从而在初次介绍这一模型时,更有能力帮助来访者或学员。我们也可以开始理解某些群体差异可能是什么——这朝向弄清这些差异为何存在、以及它们是否具有任何实际意义,迈出了第一步。

使用自认九型型别的研究

围绕九型问卷的研究,构成了该领域迄今工作的大多数。不过,还有少数其他研究使用了一种可靠的效标测量,其中涉及更复杂、更细致的型别判定方法,为我们提供了一些坚实的发现。

瓦格纳(Wagner, 1981)的博士论文及其后的发表(1983)就是一个好例子,它是最早一批致力于确立九型作为人格类型学之信度与效度的研究之一。在该研究中,390 名参与者先在工作坊上确定自己的九型型别,然后完成米隆伊利诺伊自评量表(Millon Illinois Self-Report Inventory)与迈尔斯-布里格斯类型指标(MBTI)。该工作坊包括对相关型别的详细口头讲解与描述、书面的型别描述、聆听各型人士分享经验、与和自己同型的他人讨论,以及与工作坊带领者的讨论。总之,关于型别的判定,综合了自我、同侪与专家的判断。这一切设计,都是为了尽可能确保型别判定过程的准确。

瓦格纳得以证明两件重要之事。第一,在这些不同人格问卷的各量表上,各型之间存在统计学上显著的差异,表明九型捕捉到了彼此不同的人格类型。第二个重要发现,是有迹象表明人们的九型型别随时间保持稳定。最初判定的型别保持不变的人所占比例,依型别而不同,从 79% 到 100% 不等,平均稳定性为 85%。有趣的是,在那些确实改变了判定的人当中,超过半数最终落定在一个与原初型别相邻的型别上,这为「侧翼」(wings)这一概念提供了初步支持。

布朗与巴特拉姆(Brown & Bartram, 2005)的研究采用了与瓦格纳类似的稳健型别判定策略,通过课程与访谈来确定样本中每个人的型别。他们的 241 名被试完成了 OPQ(职业人格问卷),得到了非常令人鼓舞的结果。第一,九种类型在大五特质上存在显著差异,且与理论预期相符;第二,分析能在大约 75% 的情况下把人归入正确的型别。

我本人的研究也沿着相似的路线,但在检验各型描述时,我试图捕捉的不只是人格特质(Sutton 等,2009)。我请 400 多名已知自身九型型别的人(其型别经由至少为期一周的课程确定)完成三份不同的人格问卷,分别是:大五、个人价值观(人们报告为指引其生活之重要事项,如安全感或自主性)以及一项内隐(即无意识)动机的测量。后一者显然难以测量,但有一种途径是使用投射测验:让被试就一幅含义模糊的图画,解释自己认为图中正在发生什么。由于图画本身含义模糊,被试不得不从自身内部把意义投射上去,而对他们的回答所作的分析,便能告诉我们一些关于其内隐动机的信息。

我通过阅读已出版书籍中的描述、并汇集合格九型教师的预期,为每一型在每项特质、价值或动机上应有的得分提出假设,再用被试的结果来检验这些假设(例如,第二型在外向性上的得分会高于其他型)。在总计 62 项个别假设中,53 项得到证实,只有一项出现了与预期相反的结果。回到我们先前关于「什么才算好的人格理论」的讨论,这项研究连同上述各项研究,都为九型作出可检验预测的能力提供了极佳的支撑。

压力点与安全点

除对各人格类型本身的描述之外,九型所作的另一项可检验预测是:我们在压力之下或处于安全之时,会以与型别相关的方式发生变化,而这些变化在九型图中由箭头表示。尽管它们可能被冠以不同的名称,如整合/解离(Riso & Hudson, 1999),这些变化都是九型理论的核心部分,已有若干研究尝试对其作进一步考察。

思拉舍(Thrasher, 1994)在其博士论文中处理了这一问题:她请近 120 名已知自身型别的参与者完成一项焦虑测量,以评估他们感到压力或安全感的程度。她也请参与者的「重要他人」分别在「平时、压力下、以及状态良好时」判定参与者的型别。遗憾的是,无论从个体自身还是从他们的重要他人那里,她都没有找到任何支持「型别之间移动」这一概念的结果——尽管这一结果可能受到前文所述事实的干扰,即重要他人唯有本身已熟悉九型时,才在型别判定上可靠。差不多同一时期,特沃米(Twomey, 1995)也尝试处理这一问题。她请 185 名参与者完成一项自我强度(ego strength)测量以代表其「安全感」程度、一项焦虑测量以代表其「压力」程度,然后将这些测量的得分,与他们在 WEPSS 的「资源充沛」与「资源匮乏」量表上的得分相比较。遗憾的是,她同样没有找到支持「沿九型箭头移动能很好地代表我们在压力或安全时的变化」这一看法的结果。

尽管这些初步结果让我们在理解压力与安全变化时应当谨慎,却不应把它们当作「这些变化并不发生」的定论。这两项研究之所以未能得到支持,很可能仅仅源于方法学上的问题。正如思拉舍(Thrasher, 1994)所建议的,该领域未来的研究应采用纵向研究,以及对压力或自我实现更为精细的测量。

应用

九型教导的一个本质部分,是它强调自我实现——朝实现自身潜能的方向成长。九型是一件帮助人们发展自我觉察的绝佳工具,让我们洞见自己与他人的行为与动机,使人际与职场关系更为顺畅。它让我们得以回应对方的意图,而非误解对方的行为,因此很适合用于团队建设与关系发展。九型不可或缺的一部分,是它就「克服自身的人格偏狭、松解人格的局限」所提供的指引。

尽管存在这一系列可观的潜在应用,用以检验这些许诺能否兑现的研究却少之又少。

将九型用于发展专业实践,已有若干文章论及。例如,勒科克(Luckcock, 2007)建议把「欣赏式探询」(appreciative inquiry)与九型相结合,用于发展教育从业者的实践研究与学习。他展示了这种结合如何能提供一条途径,去探索自身经验中的主观面向,并与他人展开协作对话。此外,鲍尔(Ball, 2009)倡导把九型用于发展护理领域的解决问题方法,尤其是在处理跨专业问题上。

奥蒙德(Ormond, 2007)运用案例研究法,考察九型培训能否提升一个由八人组成的小团队的团队效能,以及情商、人际技巧等结果。团队效能虽有所提升,其他结果却无可测量的效果——尽管这很可能是样本量太小所致。不过,参与者在访谈中确实提到自我觉察与个人成长有所改善,因此未来或许用更大的样本就能捕捉到这些变化。

我本人研究的另一个方面,是探讨九型在各种工作应用中的实用价值。我发现九型各型与工作态度及结果(如工作满意度、工作热情,乃至职业类别)之间,存在清晰且合乎理论的关系(Sutton 等,2007)。此外,我通过请 80 多名参与者在一次 4 小时的九型入门工作坊前后各完成一份问卷,检验了该工作坊对工作态度与个人发展的影响。与奥蒙德的研究类似,我使用的测量并未显示出自我觉察上的显著差异,但参与者确实报告了各种积极结果,包括对自己更深入的理解、对多样性的更多欣赏、与同事沟通的改善以及信心的提升(Sutton 等,2011)。

尽管我们在论证九型于实际情境中的实用价值方面才刚迈出第一步,进一步研究的空间仍然很大。

作为人格理论的九型

总之,我们迄今为止的研究很好地表明,九型能够满足人格心理学家所追寻的三条标准:我们能从中作出清晰、可检验的假设;它切实有用;它是综合全面的。就实际而言,我们从这些研究中学到的是:

  • 九型所描述的各人格类型,能够借助其他已确立的人格测量工具清晰地彼此区分。(示例见概括「大五」研究结果的那张表格。)
  • 诸如 RHETI 与 WEPSS 之类的九型人格问卷,其信度尚可,但对它们的效度我们仍应保持谨慎。也就是说,我们在不同场合很可能得到相同的结果,但那并不能保证它真的就是我们的型别。
  • 各型在人群中的分布大体均衡,尽管存在一些小的差异。
  • 受过训练的从业者在访谈中判定他人型别的能力相当不错,但没有他们自以为的那么好!
  • 这或许显而易见,但要在一个人属何型上作出准确判断,最好的办法是把「对这个人充分的了解」与「对九型充分的了解」结合起来。二者只有其一都不行。
  • 一旦人们辨识出自己的型别,那一型别似乎就非常稳定。
  • 有充分的证据表明,学习九型对自我接纳、自我发展以及对他人的理解都有正面影响。

迄今为止的证据当然很有希望,但绝非定论。仍有许多问题未获解答——或许根本还没被提出?我们至今还没有关于三中心、侧翼或亚型的明确研究,也没有围绕人格发展的证据。我们同样还需要进一步研究,来检验九型所提出的压力与安全变化。我们对各型的典型特质有着很好的描述,但若能了解那些自认属于某一型、却与该型「平均」特质画像不符的人究竟是何种情形,将会很有意思。而关于九型应用的确凿证据,也仍处在起步阶段。

个人的笃信是个不错的起点,但需要用「我们对什么有证据、对什么没有证据」的理解来加以调和。我们有理由在关于九型的种种主张上保持谨慎,但我也相信,我们触及的是某种好东西,并且有一个坚实的基础,让我们可以放心地把九型用于自己的生活、并介绍给他人。

九型各型在「大五」上的得分摘要

有三项研究使用「大五」(Sutton, 2007;Newgent 等,2004;Brown & Bartram, 2005)来考察九型各型,这意味着我们可以开始看出九种类型各自典型的特质画像。以下是对这些特质的简要界定。需谨记:正如九型中没有哪一型比另一型「更好」或「更差」,这些特质上的不同得分也并无优劣之分。

外向性(Extraversion):得分偏高者往往外向、喜好社交、自信;得分偏低者则更内敛、独立、注重隐私。

宜人性(Agreeableness):得分较高表明人较为信任他人、利他,倾向于随顺周围的人;得分较低则表明人更为多疑、以自我为中心、态度强硬。

尽责性(Conscientiousness):得分偏高者更为尽责、有条理、自律;得分偏低者则可能更缺乏条理、更随性。

情绪稳定性(Emotional Stability):得分高表明人从容、镇定、不易动摇;得分低则表明人易激动、情绪反应强、警觉。

经验开放性(Openness to Experience):在该特质上得分高的人往往好奇、思想开放、追求新奇;得分偏低者则更务实、更保守。

下表列出每一型在每项特质上的平均得分。

九型外向性
Extraversion
宜人性
Agreeableness
尽责性
Conscientiousness
情绪稳定性
Emotional Stability
经验开放性
Openness to Experience
第一型——高高低
第二型高高——低
第三型高低高—?
第四型低?低低高
第五型低低———
第六型低高—低低
第七型高—低高高
第八型高低高?高
第九型低高低高低

原表图例(附中译):粗体「高/低」=在多项研究中均获证实(CAPS = found in more than one study);常规字「高/低」=仅在一项研究中发现、其他研究未见复现(Lower case = found in one study and not found in others);「?」=各项研究证据相互矛盾,有的为高、有的为低(? = contradictory evidence in different studies: high in some, low in others)。表中「—」表示该项研究未报告此型在此特质上的结果。

参考文献(References)

以下参考文献按原文逐条保留,未作翻译,以便查证与检索:

Ball, E. (2009) Do professions have distinct or singular personalities? Using the enneagram to support and facilitate inter-professional nursing. Nurse Education Today, 29, 365-366.
Brown, A. & Bartram, D. (2005) Relationships between OPQ and Enneagram Types. London: SHL Group plc.
Brugha, C. M. (1998) The structure of development decision-making. European Journal of Operational Research, 104, 77-92.
Cutting, B. & Kouzmin, A. (2004) A synthesis of knowing and governance: making sense of organizational and governance polemics. Corporate Governance, 4, 76-114.
Dameyer, J. J. (2001) Psychometric evaluation of the Riso-Hudson Enneagram Type Indicator. PhD, California Institute of Integral Studies.
Daniels, D. N. & Price, V. A. (2000) The Essential Enneagram, San Francisco, HarperCollins.
Gamard, W. S. (1986) Interrater reliability and validity of judgments of enneagram personality types. PhD, California Institute of Integral Studies.
Kale, S. H. & Shrivastava, S. (2003) The enneagram system for enhancing workplace spirituality. The Journal of Management Development, 22, 308-328.
Kamineni, R. (2005) The Next Stage of Psychographic Segmentation: Usage of the Enneagram. Journal of American Academy of Business, Cambridge, 6, 315-320.
Luckcock, T. (2007) The soul of teaching and professional learning: An appreciative inquiry into the Enneagram of reflective practice. Educational Action Research, 15, 127-145.
Naranjo, C. (1994) Character and Neurosis: an integrative view, Nevada City, Gateways / IDHHB, Inc.
Newgent, R. A., Parr, P. E., Newman, I. & Higgins, K. K. (2004) The Riso-Hudson Enneagram Type Indicator: Estimates of Reliability and Validity. Measurement and Evaluation in Counseling and Development, 36, 226-237.
Ormond, C. H. (2007) The effects of emotional intelligence and team effectiveness of a newly formed corporate team learning the Enneagram. Dissertation Abstracts International: Section B: The Sciences and Engineering, 68, 2699.
Riso, D. R. & Hudson, R. (1999) The Wisdom of the Enneagram, New York, Bantam Books.
Sharp, P. M. (1994) A factor analytic study of three Enneagram personality inventories and the Vocational Preference Inventory. EdD, Texas Tech University.
Skodol, A. E., Oldham, J. M., Bender, D. S., Dyck, I. R., Stout, R. L., Morey, L. C., Shea, M. T., Zanarini, M. C., Sanilsow, C. A., Grilo, C. M., Mcglashan, T. H. & Gunderson, J. G. (2005) Dimensional Representations of DSM-IV Personality Disorders: Relationships to Functional Impairment. American Journal of Psychiatry, 162, 1919-1925.
Sutton, A. (2007) Implicit and Explicit Personality in Work Settings: An Application of Enneagram Theory. PhD, University of Leeds.
Sutton, A., Williams, H. & Allinson, C. (2007) Hidden Personality at Work - Predicting occupational outcomes by combining knowledge of employees' implicit and explicit personality. Division of Occupational Psychology. Bristol: British Psychological Society.
Sutton, A., Williams, H. & Allinson, C. (2009) Capturing patterns of traits using a typology net. British Psychological Society Division of Occupational Psychology Conference.
Sutton, A., Williams, H. & Allinson, C. (2011) Is ignorance bliss? The relationship of self-awareness to job well-being and coping strategies at work. Performance and Reward Conference. Manchester.
Thrasher, P. (1994) The enneagram: Movement between types, an inventory, and a criterion measure. PhD, Loyola University of Chicago.
Twomey, J. A. (1995) The Enneagram and Jungian archetypal images. PsyD, Chicago School of Professional Psychology.
Wagner, J. (1981) A Descriptive, Reliability and Validity Study of the Enneagram Personality Typology. PhD, Loyola University of Chicago.
Wagner, J. (1983) Reliability and validity study of a Sufi personality typology: The Enneagram. Journal of Clinical Psychology, 39, 712-717.
Wagner, J. P. (1999) Wagner Enneagram Personality Style Scales Manual, Los Angeles, Western Psychological Services.
Warling, D. L. (1995) An examination fo the external validity of the Riso Hudson Enneagram Type Indicator. MSc, University of Guelph.
Wyman, P. (1998) Integrating the MBTI and the Enneagram in Psychotherapy: The Core Self and the Defense System. Journal of Psychological Type, 46, 28-40.
Wyman, P. & Magidson, J. (2008) The effect of the Enneagram on measurement of MBTI extraversion-introversion dimension. Journal of Psychological Type, 68, 1-8.

版权说明

《九型人格期刊》(The Enneagram Journal)的版权归国际九型人格协会(International Enneagram Association)所有;未经版权持有人明确书面许可,其内容不得复制、群发至多个站点,或张贴至邮件列表(listserv)。但用户可为个人用途打印、下载或通过电子邮件传送文章。