Романтизация кожаного мешка, или почему ваш врач обязан использовать ИИ 🧑⚕️

Вчера в комментариях под постом о рынке труда был небольшой, но показательный для меня диалог. Я бы хотел сделать акцент на такой позиции:
«Я категорически презираю использование нейронок в работе врачей… думать ИИ точно не помогают. Такие „специалисты“ долго в медицине не задерживаются. В нашей работе самое важное — это уметь правильно и вовремя ДУМАТЬ головой».
Меня такое мнение немного пугает, поэтому я хочу раскрыть свою точку зрения, обосновать ее статистикой и источниками и поделиться с вами. Т.к. романтизация «человеческого клинического мышления» — это прекрасно, пока речь не заходит о вашем здоровье.
Баг в человеческой системе 😵💫
Врачи — люди. А люди устают, выгорают и подвержены когнитивным искажениям.
Ошибки диагностики — это не статистическая погрешность, это системная катастрофа. Например, только в США ежегодно около 795 000 человек получают инвалидность или умирают из-за неправильного диагноза.
Может быть, проблема в том, что врачи не следуют клиническим рекомендациям? В том числе. По усредненным данным, врачи соблюдают современные протоколы лечения лишь в 77% случаев, а некоторые исследования показывают цифры еще хуже — 55-57%. То есть почти каждое третье-четвертое назначение берется просто «из головы» специалиста.
И самое главное — медицинские знания устаревают с невероятной скоростью. Более 70% всех ссылок в современных статьях — это работы не старше 10 лет. При этом путь от публикации нового доказательного исследования до его реального внедрения в массовую клиническую практику занимает в среднем 17 лет. Выпускник медвуза выходит на работу с базой, которая уже устарела. И без использования современных технологий у него нет ни единого шанса этот разрыв сократить.
А при чем тут ИИ, спросите вы? Может он только мешать будет? Давайте и тут посмотрим на объективные данные.
ИИ не умеет думать и рассуждать? 🧠
Современные специализированные LLM уже перешагнули стадию «просто умного поиска» и демонстрируют то самое клиническое мышление, часто превосходя кожаных специалистов.
1️⃣ Google AMIE: В сравнительных испытаниях формата OSCE (имитация реальных клинических сценариев) модель AMIE превзошла врачей общей практики по 30 из 32 осей качества. Точность включения правильного диагноза в топ-3 составила 75%. Причем AMIE оказалась точнее врачей в назначениях исследований и строже следовала клиническим руководствам.
2️⃣ OpenAI o1: В исследовании, опубликованном в Science, модели с цепочкой рассуждений превзошли врачей в сложнейших задачах неотложной помощи и раннего триажа, где информации минимум, а цена ошибки максимальна.
3️⃣ Агент MIRA в интервенционной радиологии не просто ставит диагнозы с точностью 87,8% (что выше группы врачей-экспертов), но и строже следует клиническим руководствам. ИИ не забывает протоколы, потому что не дежурил вторые сутки подряд.
4️⃣ Коллективный ИИ-разум: Боитесь галлюцинаций? В NEJM AI показали, что когда три разные LLM-модели объединяются в мультиагентную систему для совместного дебата и постановки диагноза, их консенсусная точность вырастает на 16%.
Симбиоз, а не замена 🤖
Никто (в здравом уме) не предлагает выкинуть врача и посадить на его место условный ChatGPT. Речь идет о когнитивной разгрузке и подстраховке.
В одном из свежих РКИ врачи решали сложные диагностические задачи. Контрольная группа (без ИИ) показала точность 42,6%. А вот врачи, прошедшие обучение работе с ИИ и использующие GPT-4o, выдали точность в 71,4%. Разница в почти 30 процентных пунктов — это чьи-то спасенные жизни и неназначенные фуфломицины.
При прочих равных я, как пациент, всегда выберу врача, который:
🟢Свободно читает профессиональную литературу на английском.
🟢Активно использует ИИ как экзоскелет для своего мозга. Чтобы нейронка страховала его от когнитивных искажений, подсвечивала слепые зоны в анализах и мгновенно сверялась с тысячами свежих исследований на PubMed, пока человек тратит свой ресурс на эмпатию и финальное принятие решения.
Я бы хотел, чтобы именно такие специалисты подольше и оставались в медицине. И учили тех, кто до сих пор боится такого подхода.