近期公开数据显示,豆包每天承载的健康咨询超过2000万人次,而全国所有医院合计的日均诊疗人次在1000万出头。这意味着,仅豆包一个通用AI产品,每天处理的健康相关问题就已超过全国医院的总问诊量。类似情况在国外同样存在,OpenAI的ChatGPT health每周收到约3亿次健康相关询问。

长期以来,医疗行业普遍认为,垂类医疗模型在专业场景中应比通用大模型更可靠。但这一看法正受到挑战。今年6月《自然医学》发布的一项同行评审研究显示,在医学知识测试、临床判断准确度等评估中,专业医疗模型的表现不及前沿通用模型。国内针对9款产品、18次问答的测评也得到类似结果:通用模型平均分略高于垂类医疗模型。
左手医生创始人张超认为,这种现象并不意外。过去每天有上亿人在搜索引擎上检索健康内容,如今这些流量正转移到通用AI助手。对普通用户而言,80%—90%的健康问题,垂类模型和通用模型的回答质量相差不大。通用模型通过更大规模的参数、更高的训练投入和更快的迭代,也能获得并强化医疗能力,在此过程中形成了对垂类模型的降维打击。
张超判断,通用模型正在逐步吃掉单纯的健康问答层。垂类医疗公司的出路剩下两条:一是构建医疗世界模型,二是在具体的诊疗服务中做好履约。只靠对话入口做平台化生意,已经越来越难。



