Araştırma Makalesi

Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması

Cilt: 19 Sayı: 1 4 Şubat 2026
PDF İndir
EN TR

Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması

Öz

Bu çalışmada, Türkçe ve İngilizce metinler için özgün anahtar kelime üretiminde kullanılmak üzere TR Dizin veri tabanından geniş kapsamlı iki veri seti oluşturulmuş ve bu veri setleri T5 ile FlanT5 büyük dil modellerine ince ayar yapılarak değerlendirilmiştir. Hiper parametrelerin belirlenmesinde Bayesian optimizasyon yaklaşımı kullanılmış ve bu süreç modellerin öğrenme verimliliğini artırmıştır. Deneysel analizler, özellikle Türkçe modellerin hem n gram tabanlı ölçütlerde hem de anlamsal benzerlik değerlendirmelerinde yüksek başarı sağladığını göstermektedir. Elde edilen sonuçlar, büyük dil modellerinin otomatik anahtar kelime üretimi için etkili ve ölçeklenebilir bir çözüm sunduğunu ortaya koymaktadır.

Anahtar Kelimeler

Teşekkür

Bu çalışmada elde edilen sonuçların bir kısmı Doç. Dr. Yasin GÖRMEZ tarafından danışmanlığı yapılan, Şeyda Nur ARSLAN tarafından hazırlanacak olan “Türkçe Metinlerde Anahtar Kelime Tahmini: Özgün Veri Seti Oluşturulması ve Derin Öğrenme Tabanlı Model Geliştirme” başlıklı tezde kullanılacaktır. Bu çalışma aynı zamanda “Detay Danışmanlık Bilgisayar Hizmetleri Sanayi ve Dış Ticaret A.Ş” Ar-Ge merkezinde yürütülen çalışmaların bir ürünüdür, destekleri için teşekkür ederiz. Bu araştırmada yer alan kısmi nümerik hesaplamalar TÜBİTAK ULAKBİM, Yüksek Başarım ve Grid Hesaplama Merkezi’nde (TRUBA kaynaklarında) gerçekleştirilmiştir.

Kaynakça

  1. Waldherr, A. Maier, D. Miltner, P. ve Günther, E. “Big Data, Big Noise: The Challenge of Finding Issue Networks on the Web”, Social Science Computer Review, c. 35, sy 4, ss. 427-443, Ağu. 2017, doi: 10.1177/0894439316643050.
  2. Cai L. ve Zhu, Y. “The Challenges of Data Quality and Data Quality Assessment in the Big Data Era”, Data Science Journal, c. 14, sy 0, May. 2015, doi: 10.5334/dsj-2015-002.
  3. Grant, M. J. “Key words and their role in information retrieval”, Health Info Libr J, c. 27, sy 3, ss. 173-175, Eyl. 2010, doi: 10.1111/j.1471-1842.2010.00904.x.
  4. Berenci, E. Carpineto, C. Giannini, V. ve Mizzaro, S. “Effectiveness of Keyword-Based Display and Selection of Retrieval Results for Interactive Searches”, içinde Research and Advanced Technology for Digital Libraries, S. Abiteboul ve A.-M. Vercoustre, Ed., Berlin, Heidelberg: Springer, 1999, ss. 106-125. doi: 10.1007/3-540-48155-9_9.
  5. Rose, S. Engel, D. Cramer, N. ve Cowley, W. “Automatic Keyword Extraction from Individual Documents”, içinde Text Mining, John Wiley & Sons, Ltd, 2010, ss. 1-20. doi: 10.1002/9780470689646.ch1.
  6. Maragheh R. Y. ve ark., “LLM-TAKE: Theme Aware Keyword Extraction Using Large Language Models”, 01 Aralık 2023, arXiv: arXiv:2312.00909. doi: 10.48550/arXiv.2312.00909.
  7. Koloski, B. Pollak, S. Škrlj, B. ve Martinc, M. “Out of Thin Air: Is Zero-Shot Cross-Lingual Keyword Detection Better Than Unsupervised?”, 14 Şubat 2022, arXiv: arXiv:2202.06650. doi: 10.48550/arXiv.2202.06650.
  8. Altuncu, E. Nurse, J. R. C. Xu, Y. Guo, J. ve Li, S. “Improving Performance of Automatic Keyword Extraction (AKE) Methods Using PoS Tagging and Enhanced Semantic-Awareness”, Information, c. 16, sy 7, Art. sy 7, Tem. 2025, doi: 10.3390/info16070601.

Ayrıntılar

Birincil Dil

Türkçe

Konular

Bilgi Sistemleri (Diğer)

Bölüm

Araştırma Makalesi

Erken Görünüm Tarihi

4 Şubat 2026

Yayımlanma Tarihi

4 Şubat 2026

Gönderilme Tarihi

8 Aralık 2025

Kabul Tarihi

14 Ocak 2026

Yayımlandığı Sayı

Yıl 2026 Cilt: 19 Sayı: 1

Kaynak Göster

APA
Arslan, Ş. N., Görmez, Y., & Arslan, H. (2026). Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması. Bilgisayar Bilimleri ve Mühendisliği Dergisi, 19(1), 107-116. https://doi.org/10.54525/bbmd.1838196
AMA
1.Arslan ŞN, Görmez Y, Arslan H. Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması. bbmd. 2026;19(1):107-116. doi:10.54525/bbmd.1838196
Chicago
Arslan, Şeyda Nur, Yasin Görmez, ve Halil Arslan. 2026. “Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması”. Bilgisayar Bilimleri ve Mühendisliği Dergisi 19 (1): 107-16. https://doi.org/10.54525/bbmd.1838196.
EndNote
Arslan ŞN, Görmez Y, Arslan H (01 Haziran 2026) Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması. Bilgisayar Bilimleri ve Mühendisliği Dergisi 19 1 107–116.
IEEE
[1]Ş. N. Arslan, Y. Görmez, ve H. Arslan, “Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması”, bbmd, c. 19, sy 1, ss. 107–116, Haz. 2026, doi: 10.54525/bbmd.1838196.
ISNAD
Arslan, Şeyda Nur - Görmez, Yasin - Arslan, Halil. “Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması”. Bilgisayar Bilimleri ve Mühendisliği Dergisi 19/1 (01 Haziran 2026): 107-116. https://doi.org/10.54525/bbmd.1838196.
JAMA
1.Arslan ŞN, Görmez Y, Arslan H. Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması. bbmd. 2026;19:107–116.
MLA
Arslan, Şeyda Nur, vd. “Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması”. Bilgisayar Bilimleri ve Mühendisliği Dergisi, c. 19, sy 1, Haziran 2026, ss. 107-16, doi:10.54525/bbmd.1838196.
Vancouver
1.Şeyda Nur Arslan, Yasin Görmez, Halil Arslan. Türkçe ve İngilizce Anahtar Kelime Üretimi İçin Özgün Veri Seti Oluşturulması ve Büyük Dil Modellerine İnce Ayar Uygulanması. bbmd. 01 Haziran 2026;19(1):107-16. doi:10.54525/bbmd.1838196