←新聞 12 / 12→

研究突破

MedAction:朝向主動多轮臨床診斷 LLM 邁進

MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs

MedAction:朝向主動多轮臨床診斷 LLM 邁進

arXiv cs.CL · 2026-05-11

摘要

研究團隊指出現有醫療 LLM 在真實臨床診斷中存在三大缺陷:無根據的檢查訂購、不可靠的診斷更新,以及多轮一致性下降。他們提出 MedAction 框架,透過樹狀結構蒸餾管道合成高品質的多轮診斷軌跡,讓模型學會在證據不完整且不斷演變的情況下進行推理與決策,更接近實際醫學實踐。

現有醫療大語言模型多在靜態、單輪設定下接受評估,假設患者資訊在初始階段即已完整提供,這過度簡化了真實臨床實踐。研究團隊指出,真實的臨床診斷過程應包含從初步觀察開始,依序進行檢查訂購、結果解讀,並在多輪互動中更新鑑別診斷。系統性分析顯示,現有大模型存在三種反覆出現的失敗模式:缺乏依據的檢查訂購、不可靠的診斷更新,以及多輪一致性下降。這些失敗揭示了核心缺陷:現有醫療訓練數據教導模型從完整資訊進行推理,卻未教導其在演變且部分證據下採取行動。

為填補此差距,研究團隊提出 MedAction 框架,這是一套樹狀結構的蒸餾管道,透過大語言模型與環境的互動,合成多樣且高品質的多輪診斷軌跡。該框架採用兩個基於知識圖譜的指標來過濾軌跡品質:疾病軌跡一致性(Disease Trajectory Consistency, DTC)追蹤模型假設是否收斂至正確診斷,以及推理與行動一致性(Reasoning-Action Consistency, RAC)驗證信念更新是否由收集到的證據驅動。

基於此管道構建的 MedAction-32K 數據集包含來自 2,896 個 PMC 案例的 32,681 條軌跡。在該數據集上微調 8B 模型後,在 MedR-Bench 與研究團隊自建的 MedAction-300-Hard 基準測試中,均取得了開放源碼模型中的最佳表現,推動了開放源碼醫療大語言模型的邊界。

●開發者:可參考多轮醫療推理的訓練方法和評估框架

●投資人:醫療 AI 診斷系統的技術深度有望提升

●一般用戶:未來 AI 診療助手將更符合真實臨床流程,可提供更可靠的建議

重要性評分

76/100

🟠 值得關注

醫療診斷多轮推理LLM
原文出處
上一則← 自固鞏語言模型:持續將上下文知識整合入模型權重

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

相關指南

🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。