Научная статья

Оценка возможностей ChatGPT для поддержки принятия клинических решений в педиатрии: сравнительное исследование с участием педиатров с использованием KIDMAP и анализа Раша

Assessing ChatGPT's capacity for clinical decision support in pediatrics: A comparative study with pediatricians using KIDMAP of Rasch analysis

Medicine
10.1097/MD.0000000000034068
Полный текст Открыть в журнале PubMed PMC
FWCI: 1.81FWCI — Field-Weighted Citation Impact (индекс цитируемости с поправкой на область науки). 1.0 = среднее, > 1 = выше среднего · Процитировано: 59 · Ссылки: 30 · Лицензия: CC-BY-NC
Цитирование по годам: 2026: 7 · 2025: 18 · 2024: 33 · 2023: 5

Аннотация

Введение: Применение больших языковых моделей для поддержки принятия клинических решений требует дальнейшего изучения. ChatGPT — одна из наиболее известных больших языковых моделей, разработанная компанией OpenAI, — продемонстрировала многообещающие результаты в различных областях. Однако исследований, оценивающих её применение именно для принятия клинических решений в педиатрии, пока мало. Целью настоящего исследования была оценка потенциала ChatGPT как инструмента поддержки принятия клинических решений в педиатрии на основании его ответов на 8 запросов по распространённым клиническим симптомам. Исследование было направлено на решение двух задач: определить общую оценку ChatGPT по шкале от A (высокая) до E (низкая) по сравнению с нормативной выборкой и изучить различия в оценках ChatGPT, данных двумя педиатрами.

Методы: Ответы ChatGPT на 8 заданий, связанных с клиническими симптомами, часто встречающимися в практике педиатров, сравнивали между собой. Два педиатра независимо оценивали ответы ChatGPT в свободной форме. Баллы выставляли по шкале от 0 до 100, после чего преобразовывали в 5 порядковых категорий. На основании модели рейтинговой шкалы Раша смоделировали 300 виртуальных учащихся с нормальным распределением, которые оценивали задания; их сложность находилась в диапазоне от −2 до 2,5 логитов. Для решения двух задач, поставленных в исследовании, построили два вида визуализации: карту Райта и KIDMAP.

Результаты: По оценкам двух педиатров, общая результативность ChatGPT соответствовала оценке C по шкале от A до E; средние показатели составили соответственно −0,89 и 0,90 логита (логарифма отношения шансов). Оценки выявили статистически значимое различие в оценке результативности ChatGPT между двумя педиатрами (P < .05): −0,89 (SE = 0,37) и 0,90 (SE = 0,41) логита в анализе Раша.

Выводы: Исследование демонстрирует возможность использования ChatGPT как инструмента поддержки принятия клинических решений у пациентов с распространёнными педиатрическими симптомами. Полученные результаты указывают на потенциал ChatGPT для оптимизации рабочего процесса и содействия ответственному принятию клинических решений. Дальнейшее изучение и совершенствование возможностей ChatGPT в педиатрии могут способствовать улучшению результатов лечения и ведения пациентов.

Переведем эту статью за 1 час

Загрузите PDF, а мы сделаем полный перевод, краткий конспект и красивую инфографику.

Попробовать бесплатно →

Также в Подтеме: еженедельные литобзоры, база международных клинреков и конспекты свежих мед. статей и подкастов каждый день.