唐财兴 荣丽 吴珍 段孟岐
目的:比较推理模型与通用模型在护理决策支持系统中的适用性,为临床护理决策体系构建提供循
证依据。方法:统一框架构建护理决策支持系统,切换调用推理模型(DeepSeek-R1)与通用模型(GLM-
3-Turbo)完成护理计划生成、真实病例分析、考研真题解答 3 项任务,量化记录系统运行效率,由 2 名副
高职称护理专家对决策内容进行 10 分制质量评价。结果:推理模型在护理决策支持中具有最优内容质量
(3 项任务整体评价得分分别为 9.22±0.76、8.97±0.83、8.70±1.17),但运行效率低,响应时间 55.40±21.39 s、
Token 消耗量中位数为 1 716(1 367,2 934)个;通用模型准确率较高,3 项任务整体评价得分分别为 8.35±1.31、
7.60±0.89、6.90±1.41,运行效率成倍提升,响应时间 7.87±3.14 s、Token 消耗量中位数为 687(556,2 234)个。
结论:推理模型可以保证系统在复杂护理决策任务中的高准确率,但是系统效率低;通用模型准确率略低于推
理模型,但可结合知识库作为常规护理决策任务中的效率提升工具。