扎根理论是什么?2026年扎根理论开放/主轴/选择三级编码法与论文应用
当研究者面对数百页访谈记录,试图从中归纳出具有解释力的理论框架时,扎根理论提供了一套系统而严谨的操作路径。这一方法诞生于1967年,由格拉泽(Barney G. Glaser)与斯特劳斯(Anselm L. Strauss)在合著《扎根理论的发现》中首次系统阐述,其核心前提是:理论应当从数据中自然涌现,而非事先预设假设再用数据加以验证。对于选择质性路径的硕博研究生而言,扎根理论既是一种方法论选项,也是一套要求研究者高度自律的分析程序。
与现象学或民族志不同,扎根理论的目标不是”描述”一种体验,而是”建构”一套能够解释社会现象运作机制的中层理论。这意味着从第一次访谈开始,数据收集与数据分析便同步推进,彼此相互塑造。
扎根理论(Grounded Theory)是一种自下而上的质性研究方法,研究者通过对原始资料的系统编码——开放编码、主轴编码、选择编码——逐步归纳出理论范畴,以持续比较和理论饱和作为终止数据收集的判断依据。理论直接”扎根”于经验数据,而非演绎自既有文献。
一、起源与方法论立场
格拉泽与斯特劳斯最初是在医院临终关怀研究中发展出扎根理论方法的。他们观察到,当时的社会科学过度依赖演绎逻辑——先有理论,再去收集数据”检验”它——这导致大量微观社会现象无法被已有理论框架恰当捕捉。
扎根理论的哲学立场是实用主义认识论与符号互动论的结合:研究者承认意义是在社会互动中建构的,理论的价值在于其解释力与可迁移性,而非客观真理的还原。这与定量研究的实证主义假设有本质差别——后者要求可重复、可量化、可推广,而扎根理论追求的是”可转移性”(transferability)而非统计意义上的”普遍性”。
值得注意的是,格拉泽与斯特劳斯在1990年代因方法论立场分歧而产生分裂:格拉泽坚持更为归纳式的原始版本,斯特劳斯则与科宾(Juliet Corbin)合作发展出结构化程度更高的版本,即目前中文教材中最为常见的”斯特劳斯-科宾版”三级编码体系。
二、三级编码系统详解

斯特劳斯-科宾版扎根理论将编码过程划分为三个逻辑层次,层层递进,从概念到范畴,再到核心理论。
1. 开放编码(Open Coding)
开放编码是分析的第一层,目标是打破原始数据,将其分解为最小的意义单元,并赋予初步的概念标签。操作上,研究者逐行、逐句阅读访谈转录文本、田野笔记或文件资料,对每一个有意义的片段进行命名。
- 逐行编码:最精细,适用于探索性阶段。每一行文字都可能产生一个或多个初始概念。
- 逐句编码:以完整语义单元为对象,常见于数据量较大的研究。
- 逐段编码:适合对现象已有一定理解后的后期数据处理。
开放编码产出的是初始概念(concepts),数量往往较多(数十至数百个)。随后,研究者对概念进行属性与维度的分析——例如,”等待时间”这一概念具有”长度”属性,其维度可从”极短”到”极长”变化。概念的属性-维度分析是连接开放编码与主轴编码的关键步骤。
2. 主轴编码(Axial Coding)
主轴编码在开放编码产出的分散概念之间建立联系,将相关概念归并为更抽象的范畴(categories),并围绕每个范畴揭示其成因条件、情境背景、行动策略与后果。斯特劳斯与科宾将这一分析框架称为”典范模型”(paradigm model):
- 因果条件:是什么导致了这一现象?
- 现象本身:正在发生什么?
- 情境与中介条件:在什么背景与条件下?
- 行动/互动策略:行动者如何应对?
- 结果:行动产生了什么后果?
主轴编码的产出是若干有内部逻辑的范畴体系,每个范畴都拥有清晰定义、属性描述与典型数据引用。
3. 选择编码(Selective Coding)
选择编码是三级编码的最高层次,目标是在所有范畴中识别核心范畴(core category),并以核心范畴为轴心,将其他范畴整合进一个统一的理论叙事。核心范畴应满足以下标准:
- 频繁出现于数据中,与大多数范畴存在关联;
- 能够概括研究发现的核心解释逻辑;
- 在整个数据集中具有持续的分析相关性。
选择编码的成果是一个初步的实质性理论,研究者用”故事线”(story line)将核心范畴与各支撑范畴的关系清晰叙述出来,最终形成论文结果章节的理论框架。
三、编码操作示例
以下以”研究生在线学习持续参与体验”为假设研究主题,展示三级编码的操作逻辑:
| 编码层次 | 原始数据片段 | 初始概念/范畴 | 操作说明 |
|---|---|---|---|
| 开放编码 | “视频卡顿太频繁,直接就不想看了” | 技术障碍、学习中断、挫败感 | 逐句赋予初始概念标签,尽量贴近受访者用语 |
| 开放编码 | “老师在屏幕里讲,感觉和我没关系” | 师生距离感、互动缺失、存在感低 | 识别情感与关系维度的概念 |
| 主轴编码 | 将”技术障碍”+”互动缺失”+”环境干扰”等概念归并 | 范畴:在线学习体验阻断因素 | 分析因果条件(技术环境)、行动策略(放弃/寻找替代)、后果(脱落) |
| 主轴编码 | 将”同伴互助”+”即时反馈”+”自我效能感”等概念归并 | 范畴:持续参与促进因素 | 建立与阻断因素范畴的对照关系 |
| 选择编码 | 整合全部范畴,识别核心叙事 | 核心范畴:在线学习参与的动态平衡机制 | 以故事线形式说明:阻断因素与促进因素之间的张力决定了研究生持续参与的程度与方式 |
四、持续比较法
持续比较法(Constant Comparative Analysis)是扎根理论的核心分析程序,贯穿整个研究过程。其逻辑是:每收集到一份新数据,立即将其与已有数据、已有概念和已有范畴进行比较,以检视差异、丰富属性、挑战已有解释。
具体而言,持续比较在四个层面上运作:
- 事件与事件比较:识别相似或不同的行动模式;
- 事件与概念比较:验证概念标签是否准确反映数据内容;
- 概念与概念比较:判断是否需要合并、分化或重新命名概念;
- 范畴与范畴比较:揭示范畴间的逻辑关系,为选择编码做准备。
持续比较使扎根理论研究者保持对数据的高度敏感,防止过早封闭分析框架,也防止在数据尚未充分支持时草率得出结论。
五、理论饱和与理论性抽样

扎根理论不依赖预先确定的样本量,而以理论饱和(theoretical saturation)作为停止数据收集的判断依据。所谓理论饱和,是指继续收集新数据不再产生新的概念、不再修正现有范畴、不再揭示新的范畴间关系的状态。
达到理论饱和的判断需要研究者在每次数据收集后认真评估:本次访谈是否出现了意料之外的新概念?现有范畴的属性是否得到了进一步细化或修正?如果连续几次数据收集均无法丰富理论,可以初步判断接近饱和。
与之紧密相关的是理论性抽样(theoretical sampling):研究者根据当前理论发展的需要,有目的地选择下一步访谈或观察的对象与场景,以最大化数据对理论的贡献,而非追求统计意义上的代表性。这与问卷调查法中的概率抽样逻辑截然不同——扎根理论的抽样服务于理论建构,而非总体推断。
六、备忘录写作
备忘录(memos)是扎根理论研究中常被低估却至关重要的实践工具。它是研究者在分析过程中记录思维过程的非正式文档,包括对概念的初步定义、范畴间关系的假设、对数据的困惑与反思,以及理论建构的阶段性笔记。
备忘录通常分为以下类型:
- 代码备忘录:记录某一概念的内涵、外延与典型数据引用;
- 理论备忘录:记录范畴间关系的假设与演变;
- 操作备忘录:记录抽样决策、数据收集策略调整等过程性判断;
- 反思备忘录:记录研究者的立场、偏见与主观感受,用于反射性分析。
备忘录的积累构成了研究者从原始数据走向理论的可见轨迹,也是答辩时证明分析过程严谨性的重要证据。指导教师与答辩委员会往往通过要求查看备忘录来评估研究者是否真正践行了扎根理论的程序。
七、NVivo 辅助编码实操
NVivo 是目前国内外学者在扎根理论研究中使用最广泛的质性数据分析软件。它本身并不”执行”扎根理论——分析判断始终由研究者完成——但它能够显著提升编码效率与数据管理规范性。
在 NVivo 中进行扎根理论研究的基本流程如下:
- 导入数据:将访谈转录文本(Word/PDF)、田野笔记或文件资料导入项目;
- 开放编码:在”节点”(Nodes)功能区创建初始概念节点,对原始文本片段进行标注与归并;
- 主轴编码:利用”节点层级”建立概念-范畴的树形结构,使用”矩阵编码”功能检视范畴间的共现关系;
- 选择编码:创建”核心范畴”节点,使用”关系”(Relationships)功能可视化范畴间的逻辑联系;
- 备忘录整合:在各节点下关联对应备忘录,保持分析轨迹的完整性;
- 查询与检验:使用”词频查询”与”编码比较”功能进行分析质量的自我核查。
需要说明的是,NVivo 的使用需要配合方法论教材进行,软件操作本身不等于分析能力。初学者容易将”创建大量节点”误认为是”完成了扎根理论分析”,而忽视了持续比较与理论建构的核心步骤。
八、适用场景与局限
适用场景
- 理论空白领域:当研究课题尚无成熟理论框架,需要从零构建解释时,扎根理论最能发挥价值;
- 过程性研究:探索行动者如何应对、调适、作出决策的过程性问题;
- 探索隐性知识:受访者能够描述行为但难以概括其内在逻辑的场景,如职业经验、创伤适应等;
- 管理学、教育学、护理学等应用学科:这些领域的硕博论文中扎根理论应用最为普遍。
局限与常见批评
- 耗时较长:三级编码与持续比较需要研究者投入大量时间,独立完成的硕士论文若采用扎根理论,需留出充分的数据分析周期;
- “前理论”要求难以实现:格拉泽要求研究者进入研究前不进行文献综述,这在制度性学术环境中几乎无法落实,斯特劳斯版本对此做了妥协;
- 操作程序与”真正扎根”之间的张力:结构化的三级编码有时被机械执行,导致研究者”照本宣科”而非真正归纳理论;
- 推广性存疑:基于小样本质性数据建构的理论,其适用边界需要在论文局限性章节中诚实说明。
在选择研究方法时,建议参阅研究方法的系统比较分析,结合研究问题的性质、资源条件与学科规范综合判断,也可对照定量与定性数据分析方法的差异,确认扎根理论是否是最适合你课题的路径。
常见问题解答
扎根理论和现象学研究有什么区别?
两者都是质性方法,但目标不同。现象学关注”体验的本质意义”,目标是描述和阐释特定现象的普遍结构;扎根理论关注”现象的运作机制”,目标是归纳出能够解释现象的理论框架。现象学通常样本更小、分析深度更大;扎根理论的数据收集直到理论饱和才停止,更注重范畴间的关系建构而非体验描述。
扎根理论必须使用访谈数据吗?
不是。扎根理论最初基于访谈与田野观察,但其方法论同样适用于文件分析、焦点小组、在线论坛帖子等多种数据形式。关键不在于数据类型,而在于是否遵循持续比较、理论性抽样与三级编码的分析程序。部分研究也会将不同数据来源混合使用以丰富理论。
扎根理论研究需要访谈多少名受访者?
没有固定的数字标准。理论上,样本量由理论饱和决定,而非预先规定。在实践中,硕士论文通常访谈15至30人,博士论文可能达到30至60人甚至更多,具体取决于研究问题的复杂程度与受访者的同质性。开题报告中建议说明将采用”持续访谈直至理论饱和”的策略,同时给出预期范围以供导师审阅。
格拉泽版与斯特劳斯-科宾版扎根理论有哪些核心差异?
核心差异在于结构化程度与文献综述的处理方式。格拉泽坚持研究者应在不进行任何前期文献综述的前提下进入田野,以保持理论建构的”干净性”;斯特劳斯与科宾则接受文献综述作为研究设计的一部分,并引入了结构化程度更高的”典范模型”来指导主轴编码。中文学术论文中,绝大多数引用的都是斯特劳斯-科宾版的三级编码框架。
扎根理论可以和定量方法结合使用吗?
可以,但需要在方法论层面谨慎处理。一种常见模式是”质性先导-定量验证”的序列混合设计:首先用扎根理论归纳理论框架和量表维度,再通过问卷调查对量表信效度和理论模型进行验证性检验。论文中需要清晰说明两阶段的关系与各自的认识论立场,避免方法论上的自相矛盾。
如何在论文的研究方法章节呈现扎根理论分析过程?
方法章节应清晰呈现:所采用的扎根理论版本(格拉泽版或斯特劳斯-科宾版)及选择理由;数据收集流程与受访者特征(去标识化);编码程序的逐步说明,附典型编码示例;理论饱和的达成过程;研究质量保证措施(如成员检验、研究者反思)。结果章节则需以范畴体系与核心范畴为骨架,配合原始数据引用加以呈现。
整理质性数据、拆解编码逻辑
扎根理论的三级编码既需要方法论训练,也需要在大量数据面前保持耐心与条理。如果你在梳理访谈资料或撰写研究方法章节时遇到困难,Tesify 可以帮助你系统组织分析思路、整理章节结构,让方法论写作更有条理。
