Web Tabanlı Veri Toplama Yöntemleriyle Küresel Firma Bilgilerinin Analizi: İletişim Bilgileri ve Sektörsel Dağılım Üzerine Bir Çalışma
Öz
Günümüz dijital çağında veri, stratejik karar alma süreçlerinin temel bileşenlerinden biri haline gelmiştir. Web scraping yöntemi bu bağlamda, internet üzerinden otomatik veri toplama ve analiz süreçlerinde etkin bir şekilde kullanılmaktadır. Bu çalışmanın temel amacı, küresel ölçekte faaliyet gösteren firmaların iletişim bilgilerini (telefon numarası, e-posta adresi, web sitesi) sistematik biçimde elde etmek ve bu bilgileri ülke ve sektör bazında analiz etmektir. Çevrim içi kaynaklar aracılığıyla 23,985 uluslararası firma ismi toplanmış ve büyük veri hacmini yönetilebilir kılmak amacıyla firmalar gruplandırılmıştır. Veri toplama sürecinde Python dili ve ilgili kütüphaneler (Selenium, BeautifulSoup, Requests, Regex, Pandas) kullanılmıştır. Ülke tahmininde web sitesi uzantıları, coğrafi referanslar ve telefon alan kodları; sektörel sınıflandırmada ise firma adları ve web sitesi içerikleri dikkate alınmıştır. Verilerin doğruluğunu değerlendirmek amacıyla, Cochran’ın örneklem büyüklüğü formülüyle seçilen 378 birimlik örneklem üzerinde manuel analiz yapılmıştır. Sonuçlara göre, web sitesi ve telefon numarası bilgilerinin doğruluğu %90’ın, e-posta ve ülke bilgilerinin %80’in, sektör bilgisinin ise %70’in üzerindedir. Bu doğruluk oranları, web scraping yönteminin büyük ölçekli veri toplama süreçlerinde etkin ve güvenilir bir araç olduğunu göstermektedir. Ayrıca, analizde özellikle ABD, Kanada ve Birleşik Krallık gibi ülkelerde teknoloji ve sağlık sektörlerinin öne çıktığı gözlemlenmiştir.
Anahtar Kelimeler
Kaynakça
- Draxl, V. (2018). Web scraping: Data extraction from websites [Lisans tezi, University of Applied Sciences Technikum Wien]. https://www.academia.edu/35901535/BACHELOR_PAPER_Web_Scraping_Data_Extraction_from_websites
- Demir, Ö. ve Narlıkaya, Z. (2021). Muhasebe meslek mensuplarının büyük ve orta boy işletmeler için finansal raporlama standardına yönelik algılarının incelenmesi: Elazığ ili örneği. Fırat Üniversitesi Harput Araştırmaları Dergisi, 8(16), 105–125. https://izlik.org/JA75LN78ML
- Foerderer, J. (2023). Should we trust web-scraped data. arXiv Preprint. https://doi.org/10.48550/arXiv.2308.02231
- Gheorghe, M., Mihai, F. C. ve Dârdală, M. (2018). Modern web scraping techniques for data scientists. International Journal of User-System Interaction, 11(1), 63-75.
- Glez-Peña, D., Lourenço, A., López-Fernández, H., Reboiro-Jato, M. ve Fdez-Riverola, F. (2014). Web scraping technologies in an API world. Briefings in Bioinformatics, 15(5), 788-797. https://doi.org/10.1093/bib/bbt026
- Gül, M. ve Ö. Demir. (2023). Muhasebe meslek mensuplarının etik farkındalıklarının analizi: Elazığ ilinde bir araştırma. Anemon Muş Alparslan Üniversitesi Sosyal Bilimler Dergisi, 11(1), 35-49. https://doi.org/10.18506/anemon.1052583
- Hayran, O. (2012). Sağlık bilimlerinde araştırma ve istatistik yöntemler. Nobel Tıp Kitabevi.
- Khder, M. A. (2021). Web scraping or web crawling: State of art, techniques, approaches and application. International Journal of Advances in Soft Computing & Its Applications, 13(3), 145-168. https://www.i-csrs.org/Volumes/ijasca/2021.3.11.pdf
Ayrıntılar
Birincil Dil
Türkçe
Konular
İş Sistemleri (Diğer)
Bölüm
Araştırma Makalesi
Erken Görünüm Tarihi
30 Haziran 2026
Yayımlanma Tarihi
30 Haziran 2026
Gönderilme Tarihi
6 Ekim 2025
Kabul Tarihi
18 Haziran 2026
Yayımlandığı Sayı
Yıl 2026 Cilt: 8 Sayı: 1
