Ученые изучают, насколько можно доверять диагнозам языковых моделей и чем их ответы отличаются от работы врача.

Врач при столкновении с симптомом проводит поэтапную дифференциальную диагностику, задает вопросы и назначает анализы. Нейросети, например ChatGPT, выдают ответ за секунды, звучат убедительно и часто оказываются правы, но исследования ставят вопрос: есть ли за этой уверенностью настоящее клиническое мышление или это лишь удачное угадывание. Материал также обсуждает риски слепого доверия к ИИ в медицине.

Источники 1
  • Исследование: клиническое мышление ИИ — не более чем удачное угадывание Habr AI
    Есть ли у ИИ клиническое мышление — или он просто удачно угадывает
    
    Если вы обратитесь к врачу, например, с болью в груди, он не сможет прямо с порога назвать ваш диагноз. Сначала выслушает, задаст вопросы, составит список возможных вариантов и назначит анализы, чтобы поэтапно их проверить. Нейросетям же на ответ нужно несколько секунд, они звучат убедительно и почти всегда попадают в цель. Появляется соблазн — открыть ChatGPT и быстро выяснить, чем лучше лечиться. 
    
    В 2026 году вышло несколько исследований, где ученые попытались разобраться, что стоит за этой уверенностью языковых моделей, и насколько можно доверять таким ответам.  Читать дальше
    
    #машинное_обучение_в_медицине #клиническое_мышление #диагностика #медицинский_ии #галлюцинации_нейросетей #shortcut_learning #дифференциальная_диагностика #chatgpt #o1 #доказательная_медицина | @habr_ai