国内不同大型语言模型对前列腺癌围术期护理与健康教育相关问题的查询响应与效果评价
谭晓文
陈文芳
王娜娜
李惠玉
李娟
曹毓美
朱梦琪
李坤
张廷玲
傅点
东部战区总医院泌尿外科,江苏南京 210002
摘要:目的:评估国内4种拥有庞大用户基础和显著社会关注度的大型语言模型(文心一言、智谱清言、讯飞星火、通义千问)在对前列腺癌围术期护理与健康教育相关问题咨询响应的有效性.方法:编制一份包括前列腺癌根治术患者普遍关心的15个问题与2个常见护理个案的问卷,分别将问题输入4种模型进行模拟咨询,由3位护理专家根据预先设计的Likert 5级量表,从准确性、全面性、易理解性、人文关怀和案例分析等方面对模型反应进行评估,并采用可视化工具和统计分析对4种模型进行比较并评价其性能.结果:所有模型生成的文本质量良好,未发现误导性信息,都产生了令人满意的表现.通义千问各方面得分最高,且与智谱清言在多个测试中输出相对稳定;讯飞星火在易理解性方面表现较好,但在全面性和人文关怀上存在不足;智谱清言与通义千问在案例分析中均发挥了出色的表现;文心一言整体表现略逊一筹.综上所述,通义千问在前列腺癌围术期护理与健康教育咨询方面表现最好.结论:在前列腺癌围术期护理中,以通义千问为代表的大型语言模型有望成为一个强大的辅助工具,为患者提供更多的医学专业知识和信息支持,从而显著提高患者的依从性,改善临床诊疗护理质量.
关键词:前列腺癌大型语言模型人工智能健康教育
分类号:R737.25(泌尿生殖器肿瘤)R473.6(护理学)
论文发表日期:2024-02-20
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:6( 151-156 )
英文信息展开
中华男科学杂志

中华男科学杂志

CSTPCDCSCD
ISSN:1009-3591
年,卷(期):2024,30(2)
所属栏目:论著