Journal of the American Pharmacists Association : JAPhA · 2026-09-18 · 期刊论文
- 一句话结论:三种当代大语言模型在苯妥英与地高辛治疗药物监测解读上表现存在领域差异。
- 研究设计与做法:向Claude Sonnet 4.6、ChatGPT 5.5与Gemini 3.1 Pro提交30个结构化临床情景,由两名评分者盲法独立评分。
- 主要结果:评估覆盖七个临床推理领域,并采用定性错误分类法刻画模型的失败模式。
- 值得关注:摘要未报告具体得分与一致性数据,情景题为模拟案例,结论外推至真实临床药学实践需谨慎。
🔗 打开原文
Azmakan H, Azamakan T.
本文摘自《每日前沿研究简报 · 2026-09-20》「AI 科研智能体」。本内容仅用于研究信息整理与科普交流,不构成医疗建议。

发表评论 取消回复