大语言模型和检索增强生成在生物安全智能问答中的性能评价
DOI:
CSTR:
作者:
作者单位:

作者简介:

通讯作者:

中图分类号:

基金项目:

浙江省卫生健康行业科技计划(WKJ-ZJ-26039)


Author:
Affiliation:

Fund Project:

  • 摘要
  • |
  • 图/表
  • |
  • 访问统计
  • |
  • 参考文献
  • |
  • 相似文献
  • |
  • 引证文献
  • |
  • 资源附件
  • |
  • 文章评论
    摘要:

    摘要:目的评价大语言模型(ILM)和检索增强生成(RAG)在生物安全智能问答中的性能,为ILM+RAG在垂直领域的应用提供依据。方法采用RAGflow-vO.18搭建知识库,包括生物安全体系文件和浙江省生物安全操作指引文件,通过API调用实现智能问答。在深度求索(DeepSeek)R1、生成式预训练聊天机器人(ChatGPT)4o、通义千问(Qwen)3和RAG中采用统一的提示词提问59个生物安全问题。20名经培训的评测者对回答结果采用李克特分数(5分制)从全面性、准确性、清晰性、相关性进行评价并进行统计学分析。结果智能问答的总体评分(均值±标准差)为RAG(4.50±0.68分)、DeepseekR1(4.02±0.88分)、Qwen3(3.94±0.92分)、ChatGPT 4o(3.93±0.87分);评分<2分和幻觉的百分率分别为Qwen3(6.3%,33.8%)、ChatGPT4o(4.9%,15.3%)、DeepSeek R1(5.2%,8.5%)、RAG(1.0%,0.0%)。智能问答RAG的性能优于LLM(DeepSeekR1、ChatGPT4o、Qwen3),且在全面性、准确性、清晰性、相关性比较差异均有统计学意义(P均<0.001)。结论RAG在生物安全智能问答的性能优于LIM。

    Abstract:

    参考文献
    相似文献
    引证文献
引用本文

刘涛,齐星伦,范利娜,杨大干.大语言模型和检索增强生成在生物安全智能问答中的性能评价[J].临床检验杂志,2026,44(02):115-119

复制
分享
相关视频

文章指标
  • 点击次数:
  • 下载次数:
  • HTML阅读次数:
  • 引用次数:
历史
  • 收稿日期:2025-09-10
  • 最后修改日期:
  • 录用日期:
  • 在线发布日期: 2026-04-16
  • 出版日期:
文章二维码
您是第位访问者  苏ICP备13058113号-3
苏公网安备32010202012004号
主管单位:江苏省医学会  出版单位:临床检验杂志
单位地址:江苏省南京市中央路42号  邮编:210008
电话:025-83620683 E-MAIL:lcjyzz@163.com
技术支持:北京勤云科技发展有限公司