Page 62 - 《软件学报》2026年第7期
P. 62
王璐瑶 等: 面向 Discord 平台的开源软件实践者沟通实证研究 2747
2.3.1 沟通交流互动模式解析
在数据集 II 中, 我们按照置信度 99% 和误差幅度 10% 的统计标准, 随机抽取了 175 个对话样本 (每个社区
25 个), 并基于该样本对互动模式进行了人工解析. 具体而言, 人工解析涵盖两个维度: (1) 通过对话中消息的时序
与语义关联, 确定对话参与者的身份属于对话发起者 (提问方) 或回应者 (解答方); (2) 依据信息搜索意图分类体
系 [33] , 详见表 2, 解析每条消息的意图.
表 2 消息意图分类
编码 意图 定义与描述
OQ 原始问题 对话发起者提出的第1个问题
PA 潜在答案 解决原始问题的潜在回答或解决方案
NF 消极反馈 无法解决原始问题的反馈
PF 积极反馈 可以解决原始问题的反馈
FQ 跟随提问 对话参与者针对相关讨论提出新的问题
CQ 澄清问题 对话参与者要求对话发起者澄清原始问题
FD 提供细节 对话参与者提供更多细节
GG 问候感谢 表示问候或者感谢
UI 无效信息 表示同情或者重申社区规则
进一步地, 结合对话中参与者数量及多类型意图消息的语义特征, 归纳 Discord 平台开源社区的沟通互动模
式, 如图 3 所示.
P9 UI FD P8
P1 ≥2 识别回答者意图 CQ 识别回答者意图
No FD P7
No FQ
潜在答案 P2
数量
≥2 识别提问者意图
=1 CQ FQ P10
对话参与者
对话
数量
识别回答者意图
=1 =1 P5 No CQ No FQ P4
潜在答案
数量 识别提问者意图
=0 P6 FQ P3
图 3 对话中的互动模式提取流程
2.3.2 讨论主题分析
为识别对话主题以及互动模式, 对数据集 II 中的对话进行主题分析 (thematic analysis) [34] , 具体包含如下步骤.
步骤 1: 编码 (coding). 从数据集 II 中每社区随机选取 10 个对话, 共 70 个对话, 两位作者分别进行编码. 具体
而言, 独立研读对话内容, 考虑讨论主题、参与人员及消息意图, 对对话主题以及交互模式进行编码. 为确保编码
的一致性和准确性, 对于初始编码中的分歧, 讨论直至达成共识. 此阶段需要对编码规则进行快速调整与迭代, 因
此选择较小样本量. 这一设计既有助于降低两位作者在反复迭代编码规则中的时间与认知成本, 也能够支持开展
更精细的编码研判, 从而保障编码规则迭代的效率与准确性.

