Радіолог, який переглядає КТ черевної порожнини, оцінює не одну хворобу, а багато органів і можливих змін. DAMO RADAR — візуально-мовна модель дослідницького підрозділу Alibaba, створена за участю клінічних партнерів, — покликана допомагати в такому широкому пошуку. Вона аналізує КТ із контрастуванням щодо 146 клінічних знахідок у 18 органах і анатомічних структурах, зокрема злоякісних пухлин. Результати дослідження опубліковані в Science. Йдеться про знахідки та відхилення, а не обов’язково про 146 окремих діагнозів.
3
4
12
Як модель виходить за межі пошуку однієї хвороби
Замість того щоб навчати окремий детектор для кожного захворювання, розробники використали пари КТ-зображень і пов’язаних із ними клінічних висновків. Так модель вчиться співвідносити те, що видно на знімках, із тим, як лікарі описують знахідки в тексті. Цей підхід зменшує потребу щоразу створювати новий набір вручну позначених зображень для кожного стану. Водночас доступні повідомлення не дають змоги докладно перевірити реалізацію навчання або стверджувати, що модель надійно розпізнаватиме будь-яку нову хворобу.
5
16
Що означають результати випробувань
На майже 40 тисячах реальних обстежень середній показник AUC становив 0,913 для 146 оцінюваних знахідок. AUC відображає, наскільки добре модель розрізняє випадки з певною знахідкою і без неї за різних порогів ухвалення рішення. Це не означає, що вона ставить правильний діагноз у 91,3% випадків.
14
15
Окремо результати порівняли з роботою 26 радіологів: за показником, використаним у цьому дослідженні, модель випередила 23 із них. Коли лікарі працювали з підказками ШІ, кількість пропущених знахідок, за повідомленнями, зменшилася приблизно на 10%, а час аналізу — приблизно на 30%. Це вказує на можливе підвищення чутливості виявлення, але доступні дані не дають точних значень чутливості лікарів до й після допомоги моделі. Також незрозуміло, чи 10% означає відносну зміну, чи зміну у відсоткових пунктах.
1
6
14
Як модель працює поза умовами навчання? Наявних відомостей недостатньо, щоб навести перевірений показник або зробити висновок про її надійність на знімках з інших лікарень чи в інших групах пацієнтів.
DAMO Academy оголосила про відкритий випуск RADAR; повідомляється про доступність коду та ваг моделі. Це дає дослідникам змогу її вивчати, але не замінює перевірки перед використанням у конкретній лікарні. Найобережніша потенційна роль системи — помічник радіолога, який звертає увагу на можливі пропущені зміни, а не самостійний діагност.
3
4
6
7