Новое исследование из Гарварда сравнило диагнозы искусственного интеллекта и врачей в отделении неотложной помощи. Результаты впечатляют, но вызывают вопросы о готовности технологий к реальной практике.
Специалисты Гарвардской медицинской школы и Медицинского центра «Бет-Исраэль Диаконесс» опубликовали работу в журнале Science. Они протестировали большие языковые модели, в частности o1 и 4o, на реальных клинических случаях.
Результаты эксперимента
Исследователи проанализировали 76 пациентов. Диагнозы двух врачей внутренней медицины сравнили с выводами ИИ. Оценку проводили независимые врачи.
Модель o1 показала точность не ниже, чем у врачей, а в некоторых случаях — даже выше. Особенно на этапе первичного осмотра, когда данных минимум, а решение нужно принимать срочно.
- ИИ o1: 67% точных или близких диагнозов на триаже.
- Первый врач: 55%.
- Второй врач: 50%.
Модели получали ту же текстовую информацию из медицинских записей, что и врачи. «Мы протестировали модель практически по всем показателям, и она превзошла как предыдущие модели, так и наших врачей в контрольной группе», — отметил Арджун Манраи, руководитель лаборатории ИИ в Гарварде.
Ограничения и мнения экспертов
Авторы подчеркивают необходимость клинических испытаний. ИИ обрабатывал только текст, игнорируя изображения или анализы.
Врач Адам Родман подчеркивает: «На данный момент не существует четкой системы ответственности за диагнозы ИИ». Пациенты хотят человеческого сопровождения.
Кристен Пантагани, врач неотложной помощи, считает сравнение некорректным. ИИ соревновался с врачами внутренней медицины, а не со специалистами экстренной помощи. «Если сравнивать ИИ с врачами, нужно брать именно тех, кто работает в этой специализации», — пояснила она.
В отделении приоритет — выявление угрозы для жизни, а не точный диагноз. Даже лучшие модели остаются инструментом, а не заменой врача.
ИИ в самодиагностике
Многие уже используют чат-боты для анализа симптомов. По данным источников, 1 из 6 взрослых регулярно ищет медицинскую информацию в ИИ.
Преимущества: скорость, анонимность. Риски: неточность в половине случаев, ошибочные рекомендации, чрезмерное доверие.
Известны инциденты с опасными рекомендациями. Эксперты советуют: ИИ — лишь ориентир. Для постановки диагноза обращайтесь к врачу. Технологии не видят пациента и не несут ответственности.