華佗GPT是由香港中文大學(深圳)聯合深圳市大數據研究院研發的開源中文醫療大模型,採用混合數據集微調和基於AI反饋的強化學習技術構建。該模型於2023年2月首次發布,成為國內首個類ChatGPT的醫療大模型,其智慧型導診系統截至2024年4月已在深圳市龍崗區人民醫院、龍崗區第三人民醫院等12家公立醫院部署,服務超5萬人次。憑藉超過2600萬條醫療對話數據的訓練,模型在多輪診療互動場景中展現出優於GPT-3.5-turbo的性能。
基本介紹
- 研發團隊:王本友教授團隊
- 發布時間:2023年2月
- 技術核心:RLAIF強化學習
- 套用場景:智慧型導診/預問診
- 開源數據:Huatuo-26M數據集
- 參數量級:百億級別
研發背景
技術路徑
- 指令微調:融合ChatGPT生成的互動數據與真實醫生診療對話數據
- 強化學習最佳化:通過AI反饋機制提升診斷邏輯的嚴謹性
- 多模態擴展:支持語音互動及醫學影像分析功能訓練數據集包含2600萬條醫療對話,涵蓋20個臨床科室的專業知識。
套用落地
性能突破
開源生態
發展規劃
- 疾病預測:整合基因組數據提升早篩準確率
- 決策支持:開發面向臨床醫生的智慧型輔助模組
- 全球部署:建立跨語言醫療問答系統
