Research Article

Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study

Volume: 16 Number: 2 August 6, 2026
EN

Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study

Abstract

Aim: The objective of this study was to evaluate the efficacy of ChatGPT in providing pregnancy-related health information in English, Turkish, and Arabic, with a focus on medical accuracy, empathetic communication, clarity, and appropriateness of referral to obstetricians. This research aims to address concerns regarding the variability of response accuracy and quality across different languages. Methods: A prospective observational study was conducted within the Department of Obstetrics and Gynecology. Fifteen commonly asked pregnancy-related questions were translated into Turkish and Arabic by certified translators to ensure linguistic accuracy. Responses generated by ChatGPT in English, Turkish, and Arabic were independently assessed by four experienced obstetricians. Evaluation criteria included medical accuracy, empathetic tone, clarity, and appropriateness of referral. Statistical analysis was performed using chi-square tests, with statistical significance defined as p < 0.05. Results: Statistically significant differences were identified across languages in terms of medical accuracy (p = 0.0012), empathetic tone (p < 0.001), and clarity (p < 0.001). Responses provided in English were rated as “excellent” in 73.3% of cases, compared to 40% in Turkish and 41.6% in Arabic. Overall, more than 80% of all responses were rated as either “good” or “excellent.” No significant difference was observed concerning the appropriateness of referral recommendations (p = 0.0885). Conclusions: ChatGPT demonstrates potential as a reliable tool for addressing pregnancy-related health inquiries. However, discrepancies in response accuracy and clarity across languages highlight the need for improved language support, particularly for underrepresented languages. Future research should include a broader range of questions and additional languages to enhance the reliability and clinical applicability of this technology.

Keywords

References

  1. 1. Zhang J, Lu JD, Chen B, Pan S, Jin L, Zheng Y, et al. Vision transformer introduces a new vitality to the classification of renal pathology. BMC Nephrol. 2024;25(1):337. https://doi.org/10.1186/s12882-024-03800-x
  2. 2. Chen Z, Yadollahpour A. A new era in cognitive neuroscience: the tidal wave of artificial intelligence (AI). BMC Neurosci. 2024;25(1):23. https://doi.org/10.1186/s12868-024-00869-w
  3. 3. Raiaan MAK, Mukta MSH, Fatema K, Fahad NM, Sakin S, Mim MMJ. A review on large language models: architectures, applications, taxonomies, open issues and challenges. IEEE Access. 2024;12:26839–26874. https://doi.org/10.1109/ACCESS.2024.3365742
  4. 4. Porto BM. Improving triage performance in emergency departments using machine learning and natural language processing: a systematic review. BMC Emerg Med. 2024;24(1):219. https://doi.org/10.1186/s12873-024-01135-2
  5. 5. Chung P, Fong CT, Walters AM, Yetisgen M, O’Reilly-Shah VN. Prediction of American Society of Anesthesiologists physical status classification from preoperative clinical text narratives using natural language processing. BMC Anesthesiol. 2023;23(1):296. https://doi.org/10.1186/s12871-023-02248-0
  6. 6. Zhao WX, Zhou K, Li J, Tang T, Wang X, Hou Y, et al. A survey of large language models. arXiv:2303.18223 [cs.CL]. https://doi.org/10.48550/arXiv.2303.18223
  7. 7. Gulati V, Roy SG, Moawad A, Garcia D, Babu A, Pott JD, et al. Transcending language barriers: can ChatGPT be the key to enhancing multilingual accessibility in healthcare?J Am Coll Radiol 2024;21(12):1888–1895. https://doi.org/10.1016/j.jacr.2024.05.009
  8. 8. Grünebaum A, Chervenak J, Pollet SL, Katz A, Chervenak FA. The exciting potential for ChatGPT in obstetrics and gynecology. Am J Obstet Gynecol. 2023;228(6):696–705. https://doi.org/10.1016/j.ajog.2023.03.009

Details

Primary Language

English

Subjects

Clinical Sciences (Other)

Journal Section

Research Article

Publication Date

August 6, 2026

Submission Date

March 25, 2025

Acceptance Date

April 21, 2026

Published in Issue

Year 2026 Volume: 16 Number: 2

APA
Coşkun, E. S., Yeniocak, A. S., Bacak, H. B., Aslan, E., Ketenci Gencer, F., & Salman, S. (2026). Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study. Kafkas Journal of Medical Sciences, 16(2), 188-195. https://izlik.org/JA46KX54HL
AMA
1.Coşkun ES, Yeniocak AS, Bacak HB, Aslan E, Ketenci Gencer F, Salman S. Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study. Kafkas Journal of Medical Sciences. 2026;16(2):188-195. https://izlik.org/JA46KX54HL
Chicago
Coşkun, Enes Serhat, Ali Selçuk Yeniocak, Havva Betül Bacak, Erkan Aslan, Fatma Ketenci Gencer, and Süleyman Salman. 2026. “Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study”. Kafkas Journal of Medical Sciences 16 (2): 188-95. https://izlik.org/JA46KX54HL.
EndNote
Coşkun ES, Yeniocak AS, Bacak HB, Aslan E, Ketenci Gencer F, Salman S (August 1, 2026) Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study. Kafkas Journal of Medical Sciences 16 2 188–195.
IEEE
[1]E. S. Coşkun, A. S. Yeniocak, H. B. Bacak, E. Aslan, F. Ketenci Gencer, and S. Salman, “Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study”, Kafkas Journal of Medical Sciences, vol. 16, no. 2, pp. 188–195, Aug. 2026, [Online]. Available: https://izlik.org/JA46KX54HL
ISNAD
Coşkun, Enes Serhat - Yeniocak, Ali Selçuk - Bacak, Havva Betül - Aslan, Erkan - Ketenci Gencer, Fatma - Salman, Süleyman. “Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study”. Kafkas Journal of Medical Sciences 16/2 (August 1, 2026): 188-195. https://izlik.org/JA46KX54HL.
JAMA
1.Coşkun ES, Yeniocak AS, Bacak HB, Aslan E, Ketenci Gencer F, Salman S. Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study. Kafkas Journal of Medical Sciences. 2026;16:188–195.
MLA
Coşkun, Enes Serhat, et al. “Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study”. Kafkas Journal of Medical Sciences, vol. 16, no. 2, Aug. 2026, pp. 188-95, https://izlik.org/JA46KX54HL.
Vancouver
1.Enes Serhat Coşkun, Ali Selçuk Yeniocak, Havva Betül Bacak, Erkan Aslan, Fatma Ketenci Gencer, Süleyman Salman. Assessment and Cross-Language Comparison of ChatGPT’s Responses to Frequently Asked Questions by Pregnant Women: A Multilingual Prospective Observational Study. Kafkas Journal of Medical Sciences [Internet]. 2026 Aug. 1;16(2):188-95. Available from: https://izlik.org/JA46KX54HL