返回新闻列表
2026-06-24 09:18

百川智能发布M4 模型,实现“真人医生”式主动问诊

文本核心速览
  1. 百川发布M4医疗大模型百川智能与清华团队发布Baichuan-M4,在HealthBench评测中包揽三项子榜单第一,表现超越GPT-5.5,展现卓越医疗专业能力。
  2. 实现主动问诊交互M4突破传统被动问答模式,模拟真人诊疗逻辑,能主动追问识别病情线索,提升问诊效率与诊断准确性。
  3. 推出全病程记忆功能M4深度整合历史病历、多轮问诊记录等,实现长上下文临床记忆,性能较上一代显著提升,确保诊疗连贯性。
  4. 引入证据锚定技术每项结论精确对应权威文献或指南具体段落,循证引用精度达90.0,在医疗决策严谨性上领先同类模型。

Baichuan-M4在HealthBench上碾压GPT-5.5,但真正狠的是它学会了主动追问

百川智能和清华大学搞出来的Baichuan-M4,刚在HealthBench医疗评测的 HardProfessional总榜 三个子榜单都拿了第一,比GPT-5.5还猛。

超越GPT-5.5

有开发者试了说,这模型逻辑推理和临床知识储备确实狠,直接干翻GPT-5.5。官方数据是吹出来的?群里在传,Baichuan-M4的医疗专业能力不是纸面功夫,在权威的HealthBench上真打出了成绩。

主动追问像真人

老的AI问诊就像个木头人,你问一句它答一句。Baichuan-M4不一样——它学会了 主动追问。有医生试过,模型能根据你给的症状,自己判断缺什么信息,然后追问“疼了多久”“有没有发烧”。这模拟真人诊疗逻辑的玩法,大大提升了问诊效率和诊断准确性。

全病程记忆

M4还搞了个 “全病程记忆” 功能。它能把患者的历史病历、多轮问诊记录、化验指标趋势、过往用药反馈全怼到一起。有测试者反馈,长上下文记忆比上一代强一截,模型在多次对话中始终掌握患者完整病史,不用每次都从头问。

证据锚定

最吓人的是 循证引用精度达到了90.0。这意味着模型每说一句医学结论,都能精确对应到权威论文或临床指南的具体段落,而不是随便甩个参考文献。有医生在群里说:这引用精度,放在医疗领域就是“几乎没错”的水平,比同类大模型严谨一大截。

谁会难受

接下来盯着看:这玩意儿真进医院后,那些靠卖问诊系统的厂商要睡不着了。尤其是一问一答型的老AI,还有那些只堆知识库不搞推理的模型,直接会被按在地上摩擦。医疗资源稀缺地区的医生倒是爽了,拿它当参考,相当于白捡一个顶尖专家助手。

来源: aibase阅读原文

其他新闻

查看全部