Grok почти сравнялся с врачами: ИИ правильно поставил диагноз в 97% случаев

Grok показал результат, сопоставимый с врачами, в исследовании по диагностике заболеваний, однако утверждения о том, что нейросеть уже «заменила врачей», не соответствуют результатам научной работы.

Исследование, опубликованное в журнале Scientific Reports, сравнивало Grok, ChatGPT и MANUS с двумя сертифицированными врачами-патологами. Нейросети анализировали 100 изображений гистологических препаратов с различными заболеваниями полости рта. Во втором раунде тестирования Grok правильно определил диагноз в 97% случаев. MANUS показал результат 96%, а ChatGPT — 94%. Врачи-патологи достигли точности 98%. Таким образом, Grok оказался близок к специалистам, но не превзошёл их.

Доверили бы вы ИИ постановку диагноза?

Доверили бы вы ИИ постановку диагноза?

При этом исследование проводилось не на реальных пациентах. Авторы использовали изображения из учебного пособия, а правильные диагнозы были предварительно подтверждены специалистами. Исследователи отдельно отмечают необходимость дополнительных испытаний на реальных клинических данных.

Другую оценку Grok 4 провели исследователи из JAMA Network Open. Они протестировали 21 языковую модель на 29 стандартизированных клинических сценариях. Grok 4 получил высокий результат, однако модели хуже справлялись с дифференциальной диагностикой — определением нескольких возможных причин заболевания. Авторы пришли к выводу, что современные ИИ пока нельзя использовать для самостоятельного принятия решений о лечении пациентов. Исследование JAMA Network Open

Grok почти сравнялся с врачами: ИИ правильно поставил диагноз в 97% случаев

Таким образом, результаты исследований говорят о развитии ИИ как инструмента для медицинской диагностики, а не об исчезновении профессии врача. Grok уже способен показывать результаты, близкие к специалистам в отдельных стандартизированных задачах, но это существенно отличается от полноценного обследования пациента, постановки диагноза и назначения лечения.

Доверили бы вы ИИ постановку диагноза, если бы он показывал точность на уровне опытного врача?

НовостиЖелезо и технологииискусственный интеллект

Источник: vgtimes.ru

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев