ChatGPT ve tıp fakültesi 6. sınıf öğrencilerinin ayırıcı tanı yeterliliğinin karşılaştırılması


Tezin Türü: Tıpta Uzmanlık

Tezin Yürütüldüğü Kurum: Hacettepe Üniversitesi, Tıp Fakültesi (Türkçe), Türkiye

Tezin Onay Tarihi: 2025

Tezin Dili: Türkçe

Öğrenci: ZEYNEL CANER KAYMAK

Danışman: Mehmet Ali Karaca

Açık Arşiv Koleksiyonu: AVESİS Açık Erişim Koleksiyonu

Özet:

Bu çalışmada, intörn doktorların ayırıcı tanı koyma yetkinlikleri, ChatGPT ile karşılaştırılmıştır. Çalışma, Hacettepe Üniversitesi Tıp Fakültesi'nde 120 öğrencinin katılımıyla gerçekleştirilmiştir. ChatGPT'nin dört farklı sürümü (4o, 4o mini, 4o.1 ve 4o.1 mini) kullanılmıştır. Çalışmada 30 klinik vaka kullanılmıştır ve vakalar UÇEP-2020 müfredatına göre hazırlanmıştır. İntörnler ve ChatGPT'den vakalar için beş ön tanı ve bir en olası tanı istenmiştir. Sorular, ChatGPT'ye dil olarak uzun ve kısa metinlerle yöneltilmiştir. Yanıtlar; dolaşım, gastrointestinal, sinir-davranış, ürogenital, solunum ve multisistem kategorilerinde değerlendirilmiştir. Çalışmada, ChatGPT'nin doğru cevap oranlarının genel olarak intörn doktorlardan daha yüksek olduğu görülmüştür. İntörnlerin doğru cevap ortancası %66.7 iken, ChatGPT'nin (kısa ve uzun metinlerde) %83.3 olarak bulunmuştur. Alt kategoriler incelendiğinde, dolaşım ve gastrointestinal sistem sorularında ChatGPT'nin doğru cevaplarının ortancası %87.5'in üzerinde iken, sinir-davranış ve solunum sistem sorularında intörnler ile ChatGPT arasında daha düşük bir fark gözlemlenmiştir. Ön tanı doğruluk oranlarında ChatGPT ve intörnler arasında benzer sonuçlar elde edilmiştir. İstatistiksel analizlerde, toplam doğru cevap oranlarında anlamlı bir fark bulunurken (p=0.004), ön tanıların doğruluk oranlarında anlamlı bir fark saptanmamıştır. ChatGPT sürümleri arasında ise uzun ve kısa metinler açısından anlamlı bir performans farkı tespit edilmemiştir. Sonuç olarak ChatGPT'nin kesin tanı belirlemede intörnlerden daha yüksek doğruluk oranına sahip olduğu tespit edilmiştir. Ancak, ChatGPT'nin detaylı ve sadeleştirilmiş soru metinlerine verdiği yanıtlar arasında performans farkı bulunmamıştır. Yapay zekanın acil tıp hizmetlerinde yardımcı bir araç olarak kullanılabilmesi için daha fazla araştırmaya ihtiyaç vardır.