模型 / 官方
谷歌医疗AI系统AMIE首次实现实时视频问诊,临床评估表现优异
谷歌研究院与谷歌DeepMind近日发布了医疗AI系统AMIE的最新进展,首次在模拟临床环境中展示了实时视频问诊能力。AMIE基于Gemini大模型与Project Astra,采用多智能体架构,能够实时解读患者的视觉与听觉线索,引导虚拟体格检查,并进行诊断推理。在一项随机对照研究中,研究人员邀请患者演员与一组全科医生分别参与模拟问诊,临床评估人员从病史采集完整性、诊断准确性、治疗方案合理性及沟通质量等核心临床能力维度对AMIE进行评分,结果均获得正面评价。参与测试的患者演员也表示更偏好视频问诊体验,而非纯文字对话。谷歌强调,AMIE目前仍属研究系统,在负责任地应用于真实临床场景之前还需开展更多研究,但此次进展为医疗AI的未来发展提供了令人期待的参考方向。
医生在诊室中的判断往往超越语言本身——他们会注意到患者的咳嗽声、步态变化或面部不适表情。正是基于这一临床现实,谷歌研究院与谷歌DeepMind将旗下医疗AI系统AMIE的能力边界拓展至实时视频问诊领域,并发布了该领域首个同类研究成果。
AMIE的技术底座是谷歌的Gemini大模型与Project Astra,整体采用多智能体架构设计。在视频问诊场景中,系统能够同步处理音频与视频信息,实时捕捉患者的语言表达、肢体动作及可见体征,并在此基础上引导虚拟体格检查流程,完成端到端的诊断推理。
为评估AMIE的实际表现,研究团队设计了一项随机对照研究,由经过专业培训的患者演员模拟真实就诊场景,同时邀请一组全科医生作为对照组。临床评估人员从病史采集完整性、诊断准确性、治疗方案合理性以及医患沟通质量四个核心维度进行打分,AMIE在各项指标上均获得正面评价。
值得关注的是,参与研究的患者演员在体验对比后,明确表示更偏好与AMIE进行视频问诊,而非此前的纯文字对话形式。这一用户偏好数据表明,视频模态的引入显著提升了AI问诊的自然度与交互体验,也为后续产品化探索提供了重要参考。
谷歌方面明确指出,AMIE目前仍是一个研究性系统,距离负责任地部署于真实临床环境还需要经历更多严格的安全性与有效性验证。尽管如此,此次研究成果已为医疗AI在多模态感知、实时推理与临床交互等方向的发展潜力提供了具有说服力的早期证据。
要点
- AMIE基于Gemini与Project Astra的多智能体架构,首次实现了实时视频问诊中的视听信息同步解析与诊断推理
- 在随机对照模拟研究中,AMIE在病史采集、诊断准确性、治疗方案及沟通质量等核心临床维度均获临床评估人员正面评价
- 患者演员在体验后更偏好视频问诊形式,表明多模态交互相比纯文字对话具有更高的用户接受度
- 谷歌强调AMIE仍为研究系统,真实临床部署前需完成更多安全性与有效性验证工作
原始标题:AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。