Elmi nəşr

Appendisit şübhəsində cərrahi qərar: GPT-3.5 və maşın öyrənməsi modelinin müqayisəsi

Bu çoxmərkəzli tədqiqatda süni intellekt modeli GPT-3.5-in appendisit şübhəsi ilə müraciət edən xəstələrdə "əməliyyat, yoxsa konservativ müalicə" qərarını sertifikatlı cərrahın qərarına nə dərəcədə uyğun verdiyi yoxlanılıb. Nərmin Məcid işin həmmüəlliflərindəndir.

Məqalənin məlumatları

  • Orijinal ad: Feasibility of GPT-3.5 versus Machine Learning for Automated Surgical Decision-Making Determination: A Multicenter Study on Suspected Appendicitis
  • Jurnal: AI (MDPI), 2024, cild 5, nömrə 4, səh. 1942–1954
  • Tarixlər: təqdim — 20.08.2024; qəbul — 14.10.2024; dərc — 16.10.2024
  • DOI: 10.3390/ai5040096 · preprint: 10.20944/preprints202409.2358.v1
  • Müəlliflər (11): Sebastian Sanduleanu, Koray Ersahin, Johannes Bremm, Narmin Talibova, Tim Damer, Merve Erdogan, Jonathan Kottlors, Lukas Goertz, Christiane Bruns, David Maintz, Nuran Abdullayev
  • Onun affiliasiyası: Department of Internal Medicine III, University Hospital, Ulm, Germany

Nərmin Məcidin töhfəsi (jurnalın müəllif töhfəsi bölməsinə görə)

  • Resurslar — K.E., C.B., D.M. və N.A. ilə birlikdə
  • Layihənin idarə olunması — K.E., J.B., C.B., D.M. və N.A. ilə birlikdə

Tədqiqat nə haqqındadır?

Appendisitin yüngül formalarında əməliyyatsız müalicə də mümkündür, lakin qərar həmişə asan olmur. Tədqiqatçılar 2022-ci ilin oktyabrından 2023-cü ilin oktyabrına qədər Almaniyanın iki xəstəxanasının (GFO Kliniken Troisdorf və Köln Universitet Xəstəxanası) təcili yardım şöbəsinə sağ tərəfdə qarın ağrısı ilə müraciət edən xəstələrin klinik, laborator və radioloji məlumatlarını mətn şəklində GPT-3.5-ə təqdim ediblər. Modelin cavabları həm maşın öyrənməsi modeli, həm də sertifikatlı cərrahın qərarı (istinad standartı) ilə müqayisə olunub.

Əsas nəticələr

  • 113 halın 102-sində GPT-3.5-in qərarı cərrahın qərarı ilə üst-üstə düşüb; cərrahın konservativ müalicə seçdiyi bütün hallar düzgün təsnif olunub.
  • GPT-3.5-in dəqiqliyi 90,3% (95% etibarlılıq intervalı: 83,2–95,0) olub; maşın öyrənməsi modelinin validasiya dəqiqliyi 87,0% idi. Fərq statistik əhəmiyyətli deyil (p = 0,21).
  • Müəlliflər nəticəni təcili yardım şöbəsində qarın ağrısı olan xəstələrdə cərrahlarla GPT-3.5 arasında yüksək uyğunluq kimi qiymətləndirirlər.

Bu nə demək deyil?

Bu, retrospektiv məlumatlarla aparılmış ilkin araşdırmadır; GPT-3.5 tibbi cihaz kimi təsdiq olunmayıb və cərrahın qərarını əvəz etmir. Nərmin Məcid cərrah deyil; onun bu işdəki rolu yuxarıda göstərilən resurs və layihə idarəetməsi ilə məhdudlaşır.

  • Maliyyə və etika: qismən NUM 2 (Netzwerk Universitätsmedizin, FKZ 01KX2121); GFO Kliniken Troisdorf etika komitəsi (23–1061-retro).

Məqaləni jurnal saytında oxuyun

Saytda axtarış