Large Language Models in Thematic Analysis: Prompt Engineering, Evaluation, and Guidelines for Qu...

文章核心总结与翻译

一、主要内容

本文聚焦大型语言模型(LLMs)在定性研究的主题分析(TA)中的应用,针对软件工程研究中缺乏可复现的LLM集成方法及系统评估的问题,开展了系统性研究:

  1. 研究基础:基于Braun和Clarke的反思性主题分析框架,选取2-5阶段设计并迭代优化提示词,以15份软件工程师幸福感相关访谈为数据集,对比LLM生成的编码和主题与资深研究人员的成果。
  2. 研究过程:测试了ChatGPT 03 mini、GPT-4o、Gemini 2.5 Pro、Claude 4 Sonnet四款模型,由四位专家采用基于该框架质量标准的评分表进行盲评,从清晰度、相关性、主题连贯性等多维度评估输出质量。
  3. 核心发现
    • 专家在61%的情况下更偏好LLM生成的编码,认为其对研究问题的分析具有实用性;
    • LLM存在数据过度碎片化、遗漏潜在解读、主题边界模糊等局限;
    • LLM在编码的清晰度和与研究问题的相关性上表现突出,但在潜在语义与表层语义的平衡解读上存在不足。

二、创新点

  1. 提出了可复现的研究框架:将优化后的标准化提示词与评估体系结合,实现了Braun和Clarke反思性主题分析的可操作化,为LLM集成到定性研究提供了明确流程。
  2. 开展了实证对比研究:首次在软件工程定性数据中,系统对比LLM与人类生成
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

UnknownBody

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值