“全评价”视域下GenAI工具评价指标体系构建研究——专家咨询问卷(第二轮)
关于
2周前
更新
0
频次
17
题目数
分享
有问题?问问AI帮你修改 改主题:如咖啡问卷改为奶茶问卷
尊敬的专家: 您好! 衷心感谢您在第一轮德尔菲咨询中提出的宝贵意见。第一轮问卷已顺利完成,课题组根据专家评分、变异程度和开放建议,对具体指标进行了修订。本轮为第二轮专家咨询,主要目的是:检验修订后指标的重要性、必要性和表述清晰度,并对重点争议指标进行复议,同时开展指标权重咨询。 您的意见仅用于本研究的指标修订与权重确定,我们将严格匿名处理,不公开个人姓名与单位信息。 【本轮评价对象与典型使用场景】 为避免不同专家对“GenAI工具”理解不一致,请在作答时主要依据以下对象和场景: 评价对象:通用型生成式人工智能工具,如ChatGPT、DeepSeek、文心一言、通义千问等大语言模型对话与内容生成工具。 典型场景:科研知识辅助、办公写作、学习辅导、信息检索与整理、创意构思、决策辅助等。
Q1:您的姓名
:第一部分 修订后指标重要性再评价修订说明:课题组依据专家评分(均值、变异系数)、开放意见及“全评价”理论框架,对指标体系进行了修订:删除2项指标(资源占用效率、支持终端类型数量),合并2组概念重叠指标(信息新颖性与内容原创性合并为“信息新颖与创新性”;情感适应性与风格一致性合并为“场景与表达适配性”),其余指标以名称和操作性定义优化为主。评分标准(1~5分):5=非常重要,4=重要,3=一般重要,2=不重要,1=非常不重要。
:(一)形式评价维度
Q2:形式评价关注GenAI工具的技术性能与交互质量,包括响应速度、稳定性、鲁棒性、兼容性与易用性等可感知、可评价的指标。
Q3:您对形式维度指标的整体意见与建议:
:(二)内容评价维度
Q4:内容评价聚焦GenAI工具输出信息的准确性、可靠性、安全性与专业性,是评价体系的核心维度。
Q5:您对内容维度指标的整体意见与建议:
:(三)效用评价维度
Q6:效用评价关注GenAI工具的实际应用价值与社会影响,是最终、根本的评价维度。
Q7:您对效用维度指标的整体意见与建议:
:第二部分 指标权重赋权本部分用于确定三级指标体系中各指标的权重,采用层次分析法(AHP)确定一级和二级框架的相对权重,三级框架内部指标权重将以本轮第一部分重要性评分归一化形成。请您完成以下两层次判断。【AHP标度说明】请您对指标进行两两比较,判断前者相对于后者的重要程度。 1:两者同等重要 3 :前者比后者稍重要 5 :前者比后者明显重要 7 :前者比后者强烈重要 9 :前者比后者极端重要 倒数:若后者比前者重要,请选择1/3、1/5、1/7、1/9等
Q8:一级指标重要性比较
Q9:形式评价下二级指标之间的重要性比较
Q10:内容评价下二级指标之间的重要性比较
Q11:效用评价下二级指标之间的重要性比较
Q12:您对各级指标权重的建议
联系我们
问卷网公众号