ИИ превзошел врачей-людей: исследование показало, что он гораздо точнее ставит диагнозы в реальных условиях
16 августа 2026
18:00
Способен ли искусственный интеллект (ИИ) в реальных условиях работы больницы заменить врачей-людей? Именно на этот вопрос пытались ответить ученые из Гарвардского университета. По их мнению, ответ положительный.
Новое исследование уникально тем, что проводилось в реальной больничной среде — а именно в бостонской больнице Beth Israel Deaconess Medical Center.
Реклама
Большинство подобных исследований проводится в рамках какой-либо симуляции реальности, но в данном случае ученые решились применить ИИ непосредственно в работе с пациентами. Цель состояла в том, чтобы выяснить, способна ли система искусственного интеллекта выполнять то, что врачи делают каждый день, — то есть изучить сложную карту пациента и принять решение о дальнейших действиях после его поступления.
Оказалось, что большая языковая модель (LLM) превзошла врачей не в одной области, а сразу во многих из этих задач. В том числе в принятии решений в отделении неотложной помощи на основе доступной информации, определении вероятных диагнозов и выборе дальнейших шагов в лечении, как описано в журнале Science. «Мы тестировали модель искусственного интеллекта практически по всем критериям. Она превзошла не только более старые модели, но и наши эталонные показатели для врачей», — описал соавтор исследования Арджун Манрай.
Это не начало замены людей роботами
По мнению авторов, результаты ни в коем случае не означают, что врачи-люди стали ненужными и что их могут заменить системы ИИ в одночасье. Единственное, что (пока) следует из этого исследования, — это тот факт, что медицинский ИИ теперь можно сравнивать с человеческими медиками — и это благодаря тщательно контролируемым, строгим, проспективным клиническим исследованиям в условиях реальной медицинской помощи.
Только такие исследования, которые, безусловно, будут проводиться в ближайшие годы, по мнению Манрая, смогут сказать, следует ли, как и где такие инструменты должны быть внедрены в клиническую практику — будь то самостоятельно или в качестве вспомогательных средств для врачей-людей. В то же время ученые предупреждают, что методы, с помощью которых до сих пор сравнивали ИИ с людьми, теперь перестают работать.
ИИ не сравнится с врачом, он все еще придумывает. Эксперты подготовили руководство по его использованию
«Модели становятся все более мощными. Раньше мы оценивали их с помощью тестов с выбором из нескольких вариантов; теперь они стабильно достигают результатов, приближающихся к ста процентам, и мы уже не можем отслеживать прогресс, потому что фактически достигли предела», — сказал соавтор исследования Питер Бродур из Beth Israel Deaconess.
В исследовании эффективность медицинского ИИ анализировалась сразу несколькими способами, но основными были эксперименты, в которых ИИ-агенты получали те же задачи, что и врачи-люди. В одном эксперименте команда поручила искусственному интеллекту оценку пациентов в отделении неотложной помощи — от первоначальной сортировки до последующего решения о госпитализации. На каждом этапе модели предоставлялась только та информация, которая была бы доступна в данный момент и человеческим врачам — то есть непосредственно данные из реальных электронных медицинских карт. На их основе ИИ должен был поставить вероятный диагноз и рекомендовать, как следует действовать дальше.
«Чтобы лучше понять эффективность в реальных условиях, нам пришлось протестировать все на ранней стадии лечения пациента, когда клинические данные еще носят спорадический характер», — пояснил соавтор исследования Томас Бакли. В отличие от предыдущих работ, команда никак не обрабатывала данные, не помогала ИИ, модифицируя или дополняя для него электронную медицинскую документацию. Искусственный интеллект должен был справиться самостоятельно — он должен был понять, что означают записи в медицинской документации, что представляют собой различные аббревиатуры и упрощения, используемые врачами. «Мы вообще не обрабатывали данные заранее», — подтвердили авторы исследования.
Результаты говорят сами за себя
Результаты удивили самих авторов. «Мы думали, что это будет забавный эксперимент, но что он не будет работать так хорошо. Однако этого не произошло», — описали они. Оказалось, что именно на раннем этапе принятия решений в отделении неотложной помощи модель не только не уступала врачам-людям, но и превзошла их по точности диагноза.
Этот тест проводился на 76 реальных пациентах. При этом речь шла не о каких-то учебниковых случаях, а о реальных людях, которые пришли в настоящую больницу. При сортировке пациентов, когда информации меньше всего, система ИИ определила правильный диагноз в 67,1 процентах случаев. Эти результаты ученые сравнили с результатами двух врачей. Первый лечащий врач достиг успешности 55,3 процента, второй — 50 процентов. Система опиралась исключительно на текст в электронной медицинской документации — без визуальных обследований, без физикального осмотра, без учета отношения к пациенту. Только на записи.
При принятии решений о лечении ИИ достигла среднего результата 89 %, в то время как врачи, использующие свои полные клинические данные, достигли 34 %. Здесь необходимо добавить, что вышеупомянутая больница является передовым медицинским учреждением, где могут работать только лучшие из лучших — тем интереснее новость о «поражении» двух специалистов от робота.
Оказалось, что большая языковая модель (LLM) превзошла врачей не в одной области, а сразу во многих из этих задач. В том числе в принятии решений в отделении неотложной помощи на основе доступной информации, определении вероятных диагнозов и выборе дальнейших шагов в лечении, как описано в журнале Science. «Мы тестировали модель искусственного интеллекта практически по всем критериям. Она превзошла не только более старые модели, но и наши эталонные показатели для врачей», — описал соавтор исследования Арджун Манрай.
Это не начало замены людей роботами
По мнению авторов, результаты ни в коем случае не означают, что врачи-люди стали ненужными и что их могут заменить системы ИИ в одночасье. Единственное, что (пока) следует из этого исследования, — это тот факт, что медицинский ИИ теперь можно сравнивать с человеческими медиками — и это благодаря тщательно контролируемым, строгим, проспективным клиническим исследованиям в условиях реальной медицинской помощи.
Только такие исследования, которые, безусловно, будут проводиться в ближайшие годы, по мнению Манрая, смогут сказать, следует ли, как и где такие инструменты должны быть внедрены в клиническую практику — будь то самостоятельно или в качестве вспомогательных средств для врачей-людей. В то же время ученые предупреждают, что методы, с помощью которых до сих пор сравнивали ИИ с людьми, теперь перестают работать.
ИИ не сравнится с врачом, он все еще придумывает. Эксперты подготовили руководство по его использованию
«Модели становятся все более мощными. Раньше мы оценивали их с помощью тестов с выбором из нескольких вариантов; теперь они стабильно достигают результатов, приближающихся к ста процентам, и мы уже не можем отслеживать прогресс, потому что фактически достигли предела», — сказал соавтор исследования Питер Бродур из Beth Israel Deaconess.
В исследовании эффективность медицинского ИИ анализировалась сразу несколькими способами, но основными были эксперименты, в которых ИИ-агенты получали те же задачи, что и врачи-люди. В одном эксперименте команда поручила искусственному интеллекту оценку пациентов в отделении неотложной помощи — от первоначальной сортировки до последующего решения о госпитализации. На каждом этапе модели предоставлялась только та информация, которая была бы доступна в данный момент и человеческим врачам — то есть непосредственно данные из реальных электронных медицинских карт. На их основе ИИ должен был поставить вероятный диагноз и рекомендовать, как следует действовать дальше.
«Чтобы лучше понять эффективность в реальных условиях, нам пришлось протестировать все на ранней стадии лечения пациента, когда клинические данные еще носят спорадический характер», — пояснил соавтор исследования Томас Бакли. В отличие от предыдущих работ, команда никак не обрабатывала данные, не помогала ИИ, модифицируя или дополняя для него электронную медицинскую документацию. Искусственный интеллект должен был справиться самостоятельно — он должен был понять, что означают записи в медицинской документации, что представляют собой различные аббревиатуры и упрощения, используемые врачами. «Мы вообще не обрабатывали данные заранее», — подтвердили авторы исследования.
Результаты говорят сами за себя
Результаты удивили самих авторов. «Мы думали, что это будет забавный эксперимент, но что он не будет работать так хорошо. Однако этого не произошло», — описали они. Оказалось, что именно на раннем этапе принятия решений в отделении неотложной помощи модель не только не уступала врачам-людям, но и превзошла их по точности диагноза.
Этот тест проводился на 76 реальных пациентах. При этом речь шла не о каких-то учебниковых случаях, а о реальных людях, которые пришли в настоящую больницу. При сортировке пациентов, когда информации меньше всего, система ИИ определила правильный диагноз в 67,1 процентах случаев. Эти результаты ученые сравнили с результатами двух врачей. Первый лечащий врач достиг успешности 55,3 процента, второй — 50 процентов. Система опиралась исключительно на текст в электронной медицинской документации — без визуальных обследований, без физикального осмотра, без учета отношения к пациенту. Только на записи.
При принятии решений о лечении ИИ достигла среднего результата 89 %, в то время как врачи, использующие свои полные клинические данные, достигли 34 %. Здесь необходимо добавить, что вышеупомянутая больница является передовым медицинским учреждением, где могут работать только лучшие из лучших — тем интереснее новость о «поражении» двух специалистов от робота.
ЧИТАЙТЕ ПО ТЕМЕ :