華佗GPT

華佗GPT是由香港中文大學(深圳)聯合深圳市大數據研究院研發的開源中文醫療大模型,採用混合數據集微調和基於AI反饋的強化學習技術構建。該模型於2023年2月首次發布,成為國內首個類ChatGPT的醫療大模型,其智慧型導診系統截至2024年4月已在深圳市龍崗區人民醫院、龍崗區第三人民醫院等12家公立醫院部署,服務超5萬人次。憑藉超過2600萬條醫療對話數據的訓練,模型在多輪診療互動場景中展現出優於GPT-3.5-turbo的性能。

基本介紹

  • 研發團隊:王本友教授團隊
  • 發布時間:2023年2月
  • 技術核心:RLAIF強化學習
  • 套用場景:智慧型導診/預問診 
  • 開源數據:Huatuo-26M數據集
  • 參數量級:百億級別 
研發背景,技術路徑,套用落地,性能突破,開源生態,發展規劃,

研發背景

香港中文大學(深圳)數據科學學院聯合深圳市大數據研究院,於2022年啟動醫療大模型研發項目,旨在破解醫療資源分布不均問題。該項目由王本友教授團隊主導,整合了國家健康醫療大數據研究院(深圳)的醫療文本資源,構建了中文醫療知識庫。

技術路徑

模型採用三階段訓練框架:
  • 指令微調:融合ChatGPT生成的互動數據與真實醫生診療對話數據
  • 強化學習最佳化:通過AI反饋機制提升診斷邏輯的嚴謹性
  • 多模態擴展:支持語音互動及醫學影像分析功能訓練數據集包含2600萬條醫療對話,涵蓋20個臨床科室的專業知識。

套用落地

截至2024年9月,智慧型導診系統已在龍崗中心醫院等三家區屬醫院實現日均千次服務量,準確率達95%。2024年4月擴展至全區12家公立醫院後,累計完成13萬次醫患互動。系統通過微信公眾號提供24小時預問診服務,可自動生成電子病歷並對接掛號系統。

性能突破

2023年10月發布的第二代模型通過國家執業藥師考試,成為全球首個具備藥劑師資質的AI系統。在人工盲測中,其單輪問答準確率較ChatGPT提升12.8%,多輪問診方案的完整性超出基準模型23.6%。

開源生態

團隊公開了包含模型參數、訓練代碼及Huatuo-26M醫療問答數據集的開源方案。截至2025年1月,模型在Huggingface平台月下載量突破10萬次,被47個國家的研究機構套用於醫學自然語言處理研究。

發展規劃

根據2024年科技成果發布會披露,研發團隊計畫在三年內實現三大升級:
  • 疾病預測:整合基因組數據提升早篩準確率
  • 決策支持:開發面向臨床醫生的智慧型輔助模組
  • 全球部署:建立跨語言醫療問答系統

相關詞條

熱門詞條

聯絡我們