Bariatrik Hasta Eğitiminde Yapay Zekâ: ChatGPT 5.2’nin Güvenilirlik, Okunabilirlik ve Klinik Geçerliliğinin Çok Değerlendiricili Bir İncelemesi
Öz
Amaç: Yapay zekânın (YZ) hasta eğitiminde kullanımı yeni bir gelişme olmamakla birlikte, YZ tarafından üretilen tıbbi içeriğin doğruluğu, güvenilirliği ve klinik uygunluğu halen yeterince net olarak tanımlanmamış olup tartışma konusu olmaya devam etmektedir. Bu çalışmanın amacı, ChatGPT 5.2 tarafından sleeve gastrektomi ile ilgili en sık sorulan sorulara verilen yanıtların güvenilirliğini, okunabilirliğini ve anlaşılabilirliğini değerlendirmek ve bu yanıtları farklı düzeylerde klinik deneyime sahip cerrahlar tarafından incelemektir.
Yöntem: Sleeve gastrektomi ile ilgili 24 soru ChatGPT 5.2’ye yöneltildi ve verilen yanıtlar, farklı uzmanlık düzeylerine sahip üç genel cerrah tarafından Likert ölçeği kullanılarak değerlendirildi. Ayrıca, Flesch–Kincaid Sınıf Düzeyi ve Flesch Okuma Kolaylığı skorları kullanılarak okunabilirlik ve anlaşılabilirlik analizi gerçekleştirildi.
Bulgular: Değerlendirici içi güvenilirlik mükemmel düzeyde bulunmasına rağmen, değerlendiriciler arası güvenilirlik zayıf olarak saptandı. En yüksek klinik deneyime sahip değerlendirici en yüksek ortalama puanı verirken (2,92±0,776), ağırlıklı olarak teorik bilgiye sahip değerlendirici en düşük ortalama puanı verdi (2,58±0,881). Okunabilirlik analizinde, tüm alt kategorilerdeki yanıtlar “okunması zor” olarak sınıflandırılırken, yalnızca postoperatif süreç kategorisindeki yanıtlar “orta derecede zor” olarak değerlendirildi.
Sonuç: ChatGPT 5.2, sleeve gastrektomi hakkında genel olarak doğru ve kabul edilebilir yanıtlar sunarak hasta eğitimini destekleyen değerli bir yapay zekâ destekli sohbet robotudur. Bununla birlikte, yanıtların %4–16’sının “yanlış” olarak sınıflandırılması, genel olarak düşük okunabilirlik düzeyleri ve farklı klinik deneyim seviyelerine sahip değerlendiriciler arasında gözlenen belirgin değişkenlik, cerrahi uygulamada klinik uzmanlığın ve uzman profesyonel rehberliğin vazgeçilmez rolünü ortaya koymaktadır
Anahtar Kelimeler
ChatGPT, bariatrik cerrahi, sleeve gastrektomi, sık sorulan sorular, yapay zekâ, hasta eğitimi
Destekleyen Kurum
Yok
Etik Beyan
Çalışma, insan katılımcıları, hasta kayıtları veya kimliği belirlenebilir kişisel verileri içermemektedir. Bu nedenle, mevcut literatürde yer alan benzer çalışmaların bulguları doğrultusunda, hasta mahremiyeti veya kişisel verilerin korunmasına ilişkin herhangi bir durum söz konusu olmadığından kurumsal etik kurul onayının gerekli olmadığı değerlendirilmiştir.
Teşekkür
Yok
Artificial Intelligence in Bariatric Patient Education: A Multi-rater Evaluation of Reliability, Readability, and Clinical Validity of ChatGPT 5.2
Öz
Background: Although artificial intelligence (AI) has been used in patient education for some time, the accuracy, reliability, and clinical appropriateness of AI-generated medical content remain inadequately defined and continue to be debated. This study aimed to evaluate the reliability, readability, and comprehensibility of responses generated by ChatGPT 5.2 to the most frequently asked questions related to sleeve gastrectomy, and to assess the responses by surgeons with varying levels of clinical expertise.
Methods: Twenty-four questions regarding sleeve gastrectomy were asked to ChatGPT 5.2, and responses were evaluated using a Likert-Scale by three general surgeons with varying levels of expertise. The readability and comprehensibility analysis was also conducted, using Flesch–Kincaid Grade Level and Flesch Reading Ease Scores.
Results: Although excellent intra-rater reliability was observed, inter-rater reliability was poor. The evaluator with the greatest clinical expertise assigned the highest mean score (2.92±0.776), whereas the evaluator possessing predominantly theoretical knowledge assigned the lowest mean score (2.58±0.881). In the readability analysis, responses in all subcategories were classified as “difficult to read,” whereas only the responses within the postoperative course category were categorized as “fairly difficult”.
Conclusions: ChatGPT 5.2 is a valuable AI–assisted chatbot that facilitates patient education by providing responses regarding sleeve gastrectomy that are generally accurate and acceptable. Nevertheless, the categorization of 4–16% of the responses as "Incorrect," the overall difficult readability levels, and the significant variability observed among evaluators with different levels of clinical experience underscore the indispensable role of clinical expertise and specialized professional guidance in surgical practice.
Anahtar Kelimeler
ChatGPT, bariatric surgery, sleeve gastrectomy, frequently asked questions, artificial intelligence, patient education.
Destekleyen Kurum
The authors received no financial support for the research, authorship, and/or publication of this article.
Etik Beyan
The study did not involve human participants, patient records, or identifiable personal data. Consequently, in accordance with the findings of analogous studies documented in the extant literature, the institutional review board was deemed unnecessary, as no issues pertaining to patient privacy or personal data protection were involved
Teşekkür
None.