编码表要解决的是追溯和协作
一张看起来很整齐的表格,不一定能支撑研究判断。真正有用的编码表应该让你知道这条编码来自哪份材料、为什么这样命名、哪些片段应当排除、谁在什么时候复核过,以及定义后来如何改变。字段太少,论文写作时找不回证据。字段太多,研究者又会把精力耗在填表而不是比较材料。
设计编码表前,先写清研究问题和分析单位。做描述性主题分析的项目,未必需要“核心范畴”一列。采用扎根理论的项目,则可能需要记录条件、行动和结果之间的关系。最小可用版本比一次性设计完美模板更实际,遇到真实分歧再增加字段,表格才会跟着研究需要成长。
设想两个常见的教学情境:研究者在论文修改阶段发现,表格里有编码名称,却找不到当时依据的原文;合作者发现同一个编码在两周内被写成了两个意思。这些是假设情境,不是用户案例。编码表的价值,正是在分析过程中保留这些容易丢失的判断依据。
先确定一组最小字段
材料编号和原文位置是追溯的起点。公开表格不应放姓名或其他可识别信息,但要保留足够的编号规则,让研究者可以在受控环境中找到原段落。原文摘录也不宜只截半句:如果省略了前后条件,编码定义很容易被误解。
下面这组字段适合多数需要人工复核的项目,具体名称可以按团队习惯调整。
| 字段 | 作用 | 填写提示 |
|---|---|---|
| 材料编号与位置 | 找回证据 | 使用稳定编号、页码或段落号 |
| 原文摘录 | 保留分析依据 | 保留改变意义所需的上下文 |
| 初始编码 | 描述片段意义 | 贴近行动、感受或条件 |
| 编码定义 | 统一使用边界 | 写明纳入、排除和边界例 |
| 范畴与关系 | 连接相关编码 | 记录属性、条件、行动和结果 |
| 备忘录与复核状态 | 保存判断和进度 | 标记疑问、修改理由和版本 |
表格不是越复杂越好:项目只做经验描述时,可以暂不设置理论层级。无论采用哪种方法,材料位置、编码定义和复核状态通常都不应省略。它们分别回答“证据在哪里”“这个标签是什么意思”和“这个判断是否已经被讨论”。
字段名称也应服从团队的阅读习惯。若成员把“原文位置”理解成页码,另一位成员却记录时间戳,后续合并就会产生新的查找成本。在试编码时约定格式,并用一两个真实片段测试,往往比先画出很大的表格更实际。表格能否被持续使用,比它第一次看起来是否完整更重要。
一条编码记录应该长什么样
以下为人工编写的教学记录,P03 是虚构编号,不是产品实测输出。完整原文为:“我不确定提交以后是不是还要再确认,就先截图发给同门,让他告诉我应该点哪里。”
| 字段 | 示例填写 |
|---|---|
| 材料与位置 | 教学访谈 P03,第 1 段,第 2 句 |
| 初始编码 | 借助同伴确认操作 |
| 定义与纳入条件 | 无法判断操作步骤或完成状态时,主动请求同伴说明或确认 |
| 排除条件 | 普通闲聊;同伴未经请求主动提供建议;向管理员查询办理状态 |
| 暂定范畴 | 完成反馈不确定时的社会性确认策略 |
| 研究备忘录 | 原话支持“请求确认”,不足以推断“技术能力低”或所有人都依赖同伴 |
| 复核与版本 | 教学示例 v0.2:删除无证据的能力判断,补充排除条件;实际项目应填写真实复核人和日期 |
这条记录能让合作者检查“为什么这样编码”,也允许后来发现反例时继续修订。它只示范记录方法,不代表该解释已经在完整资料中得到验证。
定义和边界决定编码能否一致
一个可用的编码定义至少要说明现象是什么、什么证据应纳入、哪些相似表达应排除。比如“寻求同伴确认”可以限定为参与者在不确定如何理解或操作时主动询问、请求示范或评价。普通闲聊不纳入,向导师求证则另标为“寻求权威确认”,除非研究问题明确把两者合并。
定义最好带有正例、边界例和反例。另一位研究者能否根据这些说明作出相近判断,比定义写了多少字更重要。遇到“担心被评价”和“担心被误解”这类相近概念时,把分歧写进定义,往往比在会议结束后口头约定“以后统一”更有用。
定义还要和研究问题保持联系:同一个“寻求帮助”片段,在研究资源获取时可能属于策略,在研究依赖关系时又可能是互动线索。如果不说明分析目的,编码表很快会变成一份脱离语境的词典。每次修改定义时,回看几条已编码的材料,确认新边界没有不易察觉地改变旧结果。
让版本、分歧和反例留下痕迹
试编码时挑选能够体现差异的材料,而不是只选最容易的案例。两位研究者独立填写后,比较分歧集中在哪些边界,再决定是否合并或拆分编码。每次改名都应记录日期、影响范围和理由。旧编码不必直接删除,可以标记为停用,并说明它被合并到哪里。
反例也应留在表格或备忘录中:某条记录不符合主题,不代表它是“错误数据”,它可能揭示主题的条件或范围。保留历史版本,论文写作时才能解释结果为何与早期草稿不同,也方便合作研究者理解一项决定是怎样形成的。
版本记录不需要复杂的软件:日期、修改人、变化摘要和受影响的编码已经能构成基本审计线索。若某次讨论没有形成共识,可以把它标为“待决定”,并附上双方依据。这样的记录允许研究者在结果定稿后回到争议现场,而不是只剩一条无法解释的最终标签。
用 AI 草稿填表时保持人工判断
把整理好的访谈逐字稿、访谈记录或田野笔记上传到灵析后,可以获得开放编码、主轴编码和选择编码草稿,并回溯每条编码的原文位置。研究者可以把这些结果作为候选行,再补充自己的定义、纳入/排除标准、研究备忘录和复核状态。没有经过人工核对的行不应直接标为定稿。
灵析当前只处理文本材料,不支持音频或视频直接上传、转写或分析。完成讨论后,可以导出 .qdpx 衔接 NVivo,继续维护节点和项目记录。研究者仍要对标签、范畴关系和最终理论解释负责。需要了解逐字稿和编码表如何配合时,可阅读访谈逐字稿如何编码。
方法依据与参考来源
编码本可记录名称、定义、适用条件和示例,过程记录则解释这些规则如何变化。下列来源可用于设计团队编码表;它们不意味着所有质性方法都必须采用固定编码本或计算一致率。
- MacQueen, K. M., McLellan, E., Kay, K., & Milstein, B.(1998). Codebook Development for Team-Based Qualitative Analysis。用于理解团队编码本的结构和维护。
- Nowell, L. S., Norris, J. M., White, D. E., & Moules, N. J.(2017). Thematic Analysis: Striving to Meet the Trustworthiness Criteria。用于保留分析决定与审计轨迹。
常见问题
编码表应该用 Excel 还是专业软件?
两者都可以,关键是字段清楚、版本可追踪、原文可回溯。材料量大或需要团队协作时,可选择更适合项目管理的工具,小样本试编码用表格也足够。
编码定义要写多长?
以另一位研究者能据此判断边界为准。短而含糊的定义不如一两句清晰定义加正例、排除例和边界说明有效。
AI 生成的编码能直接填进编码表吗?
可以作为候选草稿行,但必须补齐原文位置、定义、复核状态和修改理由,没有人工复核的行不应标为定稿。