直擊WAIC丨百川智能M4首秀:HealthBench得分世界第一,領先GPT-5.5超10分

新浪科技
07/17

  新浪科技訊 7月17日晚間消息,2026世界人工智能大會開幕首日,百川智能首次展出Baichuan-M4在腫瘤、兒科等專科場景中的落地成果:與國家癌症中心、中國醫學科學院腫瘤醫院聯合共建的腫瘤專科AI,以及與國家兒童醫學中心、北京兒童醫院聯合共建的 AI 兒科醫生,均已在真實臨床場景中開展驗證。

  據悉,Baichuan-M4由百川智能與清華大學研究團隊聯合打造,面向醫生和個人用戶提供低幻覺、強循證、深度追問和長程記憶等醫療增強能力。這些能力既支撐百小醫服務家庭健康,也正在腫瘤、兒科等專科場景中接受臨床驗證。

  公開評測結果顯示,M4在OpenAI提出的權威醫療評測HealthBench上,綜合得分高達68.6,位列世界第一,領先第二名GPT-5.5超過10分;在最考驗複雜臨床決策的Hard子集上,領先達15.9分;事實性幻覺率降至3.3%,為全行業最低,同口徑下,GPT-5.5為3.8%、Claude Opus 4.7為6.9%、DeepSeek-V4-Pro高達9.8%。

  在循證醫學體系裏,醫生信任一條結論,靠的從來不是它說得像不像醫生,而是結論背後的證據是否權威、準確、可追溯。為此,百川不僅首創了「證據錨定」技術,讓模型生成的每一句醫學結論,都能精確對應到原始論文或指南中的具體段落,更依託六源循證範式,讓模型只在權威醫學來源中檢索,不從開放網絡抓取資料。在百川構建的循證醫學評測Baichuan-EBM上,M4的循證引用精度達到90.0,遠超同類產品。

  此外,M4 還具備了臨床所需的深度追問和超長記憶能力,能夠承接患者從首診到多次複診的完整就醫史。疊加Harness調度、記憶與自進化能力後,模型已從最強醫療大腦,升級為可完成連續診療的醫療智能體。

  當前,三甲醫院的醫生每天工作已超9.5小時,基層家庭醫生人均要管2000名簽約居民——中國的醫療資源持續面臨優質供給不足的風險。基於M4,百川帶來了「百小醫」——一款完整覆蓋全病程管理的AI家庭醫生,不僅能幫助患者明明白白看醫生,還能主動管起全家人的健康:App承接每次就醫前後的症狀問診、就醫準備、病情分析和醫囑解讀;微信 BOT 端則延伸到用戶的日常生活,持續提供主動健康管理和後續的隨訪。

  WAIC現場,百川還展示了全新的「腫瘤科AI助手」。針對腫瘤治療信息過載、決策複雜的痛點,AI助手以循證醫學為基礎,實時融合最新指南、臨床試驗與真實世界研究,將病歷解構為臨床問題並動態檢索多源證據,實現秒級精準索引。

  面向患者和家屬,面對多位專家給出的不同治療建議,患者往往難以判斷差異,也難以理解不同方案的獲益與風險,AI腫瘤醫生可將方案逐項拆解,幫助患者看清循證依據、生存獲益和不良反應,並據此與醫生進行下一步討論。試驗顯示,腫瘤科AI助手和AI腫瘤醫生與MDT專家意見在指南內方案中的一致率可達100%,指南外複雜病例一致率也高達94%。(文猛)

海量資訊、精準解讀,盡在新浪財經APP

責任編輯:劉萬里 SF014

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10