Google тестирует AMIE для клинических видеоконсультаций
Медицинская исследовательская система ИИ Google, AMIE (Видео), провела синхронные видеоконсультации с профессиональными актёрами, изображавшими пациентов, и получила от клинических экспертов оценки, сопоставимые с оценками врачей первичной медицинской помощи по нескольким ключевым показателям.
Пятнадцать обученных актёров изображали состояния, относящиеся к сердечно-лёгочной, абдоминальной, оториноларингологической, неврологической или психиатрической, а также опорно-двигательной сферам. Google отмечает, что прежде чем делать выводы о клиническом применении системы, необходимо провести исследования с участием реальных пациентов и изучением их собственных заболеваний.
AMIE распределяет видеоконсультацию между тремя агентами
AMIE использует асинхронную мультиагентную архитектуру, а не поручает ведение диалога, клиническое рассуждение и восприятие одному модельному процессу. Google заявляет, что один агент в настоящее время не может одновременно поддерживать естественную скорость ответов в разговоре, проводить детальное рассуждение и непрерывно обрабатывать аудиовизуальные данные.
Агент-говорящий отвечает за устное взаимодействие с пациентом. Он стремится поддерживать ход разговора, используя информацию от других агентов. Агент-планировщик работает в фоновом режиме, обновляя дифференциальные диагнозы и планы лечения по мере развития консультации. Он также выявляет недостающую информацию и расставляет клинические цели в новом порядке приоритетности.
Агент восприятия непрерывно анализирует видеопотоки и аудиопотоки. Он ищет невербальные признаки, результаты физикального обследования и слуховые сигналы, а затем помещает эти наблюдения в клинический контекст разговора.
Задержка остаётся ключевым фактором. Глубокое клиническое рассуждение требует времени, а долгие паузы могут повлиять на взаимопонимание во время консультации. Архитектура Google отделяет ориентированный на пациента диалог от более медленной работы по рассуждению и восприятию, позволяя агенту-говорящему отвечать, не дожидаясь завершения каждого фонового процесса.
Google сообщает, что автоматизированные оценки показали: каждый агент улучшал клинические показатели, включая сбор анамнеза, клиническое рассуждение и рекомендации по лечению. Оценки также охватывали ориентированную на пациента коммуникацию и задержку ответа.
В исследовании сравнивались AMIE с видео, AMIE с текстом и врачи
Google организовала оценку с участием людей как многоуровневое рандомизированное исследование. AMIE проводила видеоконсультации в режиме реального времени. Версия AMIE, работавшая только с текстом, обеспечивала базовый уровень для сравнения различных модальностей. Десять сертифицированных врачей первичной медицинской помощи использовали тот же видеоинтерфейс.
Независимая комиссия из 20 опытных врачей первичной медицинской помощи рассмотрела каждую консультацию с использованием устоявшихся клинических критериев оценки. Комиссия оценивала общую клиническую компетентность, а затем применяла критерии, соответствующие конкретному сценарию и адаптированные к данному случаю.
Исследование охватывало пять систем организма. Каждый сценарий следовал стандартизированному формату консультации с обученным актёром, изображавшим пациента.
Google заявляет, что эксперты оценили AMIE наравне с группой врачей первичной медицинской помощи по полноте сбора анамнеза, точности диагностики, обоснованности лечения и качеству коммуникации. AMIE (Видео) также соответствовала AMIE (Текст) или превосходила её по этим показателям.
Эксперты оценили видеосистему выше по выявлению физических признаков и проактивному руководству актёрами во время виртуальных диагностических манёвров, чем группу врачей первичной медицинской помощи или AMIE, работавшую только с текстом. Оценки восприятия и обследования с учётом конкретных случаев отражали ту же заявленную закономерность.
Актёры, изображавшие пациентов, также предпочли синхронный видеоинтерфейс текстовому чату. Google сообщает, что они сочли видео более удобным в использовании и более эффективным для описания проблем со здоровьем. По сравнению с обоими вариантами исследования актёры положительно оценили AMIE по таким параметрам, как эмпатия, взаимопонимание и уверенность в качестве помощи.
Автоматизированное тестирование предшествовало оценке врачами
Google создала набор автоматизированных тестов для разработки видеосистемы до проведения исследования с участием людей. В основу этой структуры положена таксономия компетенций телемедицины из медицинской литературы, охватывающая визуальные признаки, слуховые сигналы и манёвры физикального обследования.
Одноходовые оценки проверяли конкретные задачи восприятия и рассуждения. В качестве примеров Google приводит определение анатомической латерализации и признаки респираторного дистресса. В многоходовых имитационных аудиоконсультациях оценивалась эффективность системы в разговоре на протяжении более длительного взаимодействия.
В некоторых таких многоходовых симуляциях визуальная информация поступала в виде текстовых описаний. Например, в сценарии с болезнью Паркинсона симулятор пациента на базе ИИ мог описать пациента, держащего перед камерой лист бумаги с изображением тесного, мелкого почерка. Такая схема помогла Google проверить поведение системы в диалоге одновременно с обработкой визуальной информации, однако она не воспроизводит полноценную передачу видео в реальном времени от начала до конца.
Автоматизированный набор тестов позволил быстро изменять конструкцию системы и выявлять пробелы в её возможностях до проведения исследования с актёрами. Последующая оценка в формате OSCE использовала интерфейс синхронной видеоконсультации, хотя представления пациентов по-прежнему следовали подготовленным сценариям.
Различие между этими методами должно учитываться при обсуждении закупок и управления. Автоматизированные оценки позволяют масштабно проверять определённые задачи восприятия. Имитационные видеоконсультации позволяют оценивать качество взаимодействия в контролируемых условиях. Ни один из методов не подтверждает эффективность работы с пациентами, чьи симптомы, поведение, связь, окружение и медицинская история выходят за рамки подготовленного случая.
Практические данные по-прежнему ограничены текстовыми системами
Google указывает на несколько ограничений исследования AMIE. Профессиональные актёры не могут полностью воспроизвести разнообразие реальных встреч с пациентами. Кроме того, из сценариев исключались случаи, которые актёры не могли достоверно изобразить, включая ситуации, в которых аудиовизуальное восприятие может иметь большую диагностическую ценность.
Целевые автоматизированные оценки выявили отдельные ошибки восприятия и рассуждения. Google также сообщает о периодических технических проблемах, которые могут нарушать естественность разговора. Project Astra остаётся прототипом, а технические аспекты на уровне системы выходят за рамки этого медицинского применения. Google заявляет, что следующим этапом станет исследование с участием реальных пациентов.
Компания начала связанную работу в клинических условиях с текстовой версией AMIE. По словам Google, технико-экономическое исследование совместно с медицинским центром Beth Israel Deaconess предоставило первоначальные данные о безопасности и полезности системы в клинической практике. В продолжающемся общенациональном рандомизированном исследовании совместно с Included Health оценивается применение ИИ в реальной виртуальной медицинской помощи.
Исследование Google предоставляет контролируемые данные о поведении системы во время видеоконсультаций, руководстве физикальным обследованием и оценках врачей. Однако оно пока не доказывает, что AMIE способна безопасно диагностировать или лечить реальных пациентов в рабочей среде.
См. также: Novo Nordisk и AWS внедряют агентный ИИ в разработку лекарств
Хотите узнать больше об ИИ и больших данных от лидеров отрасли? Посетите AI & Big Data Expo, которая проходит в Амстердаме, Калифорнии и Лондоне. Это масштабное мероприятие является частью TechEx и проводится одновременно с другими ведущими технологическими мероприятиями, включая Cyber Security & Cloud Expo. Нажмите здесь, чтобы узнать больше.
AI News работает при поддержке TechForge Media. Ознакомьтесь с другими предстоящими мероприятиями и вебинарами в сфере корпоративных технологий здесь.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.