近日,Google Research 发布了其研究型医疗 AI 系统 AMIE 在视频问诊场景下的最新测试结果。这项备受瞩目的研究显示,AMIE 在通过同步视频与专业患者演员进行模拟诊疗时,其在多个核心临床指标上的表现与人类初级保健医生相当。
这一发现标志着 Google 在利用大语言模型(LLM)进行复杂医疗推理方面取得了重要进展。不同于以往的单纯文本交互,此次测试引入了“视频”这一关键模态,使得 AI 不仅能通过语言交流,还能通过视觉线索来辅助诊断,极大地提升了远程医疗场景下的模拟真实度。
AMIE:超越传统聊天机器人的医疗 AI
AMIE(AutoML for Interactive Tabletop Experiments)是 Google DeepMind 团队开发的一个研究项目。与市面上常见的基于检索生成(RAG)的聊天机器人不同,AMIE 的核心优势在于其基于推理的对话能力。它并非简单地从数据库中检索知识,而是通过模拟医患对话,不断通过提问、澄清和推理来逼近疾病的真相。
在之前的公开测试中,AMIE 在文本和语音问诊场景下已经展现出了惊人的潜力,能够处理复杂的医学推理任务。而此次新增的视频功能测试,进一步验证了该系统处理非语言信息的能力。在医疗诊断中,患者的微表情、肢体动作以及环境观察往往与语言描述同样重要。
模拟测试的严谨性
为了确保测试的公平性和严谨性,Google 的研究团队使用了 15 名经过专业培训的演员来扮演患者。这些演员模拟了五种常见的医疗领域:心肺系统、腹部系统、头颈耳鼻喉(HEENT)系统、神经精神系统以及肌肉骨骼系统。
在模拟过程中,AMIE 与演员进行了实时的视频同步交流。临床评估员在对话结束后,对 AMIE 的诊断准确率、治疗建议的有效性以及与患者的沟通质量进行了评分。结果显示,AMIE 在多个关键维度上与人类初级保健医生的表现持平,甚至在某些特定场景下表现出色。
行业影响与未来展望
这一突破对于远程医疗行业而言具有深远的意义。远程医疗虽然普及,但医生往往难以通过屏幕捕捉到患者的全部生理和心理状态。AMIE 能够通过视频分析有效弥补这一缺陷,这意味着 AI 辅助诊断系统在未来的远程问诊中将具备更高的实用价值。
Google 方面也指出,目前的测试对象为专业演员,未来仍需在真实患者环境中进行更广泛的验证。然而,随着技术的不断迭代,像 AMIE 这样的系统有望成为医生的“副驾驶”,帮助处理繁琐的初步问诊,从而让人类医生能将更多精力集中在复杂的诊疗决策和患者关怀上。
综上所述,Google AMIE 在视频问诊领域的成功测试,不仅证明了 AI 在医疗领域的可靠性正在稳步提升,也为构建更加智能、高效的医疗生态系统奠定了坚实基础。
参考来源:AI News
原文链接:https://www.artificialintelligence-news.com/news/google-tests-amie-for-clinical-video-consultations/
信息来源:AI News,原文链接:https://www.artificialintelligence-news.com/news/google-tests-amie-for-clinical-video-consultations/