Peran Keamanan Basis Data Relasional dalam Menjamin Kualitas Data untuk Proses Data Mining: Studi Kasus Klasifikasi Aktivitas Akses Berisiko
DOI:
https://doi.org/10.31004/riggs.v4i2.1418Keywords:
Keamanan Data, Basis Data Relasional, Data Mining, Decision Tree dan Naive BayesAbstract
Pertumbuhan data digital yang sangat cepat di era modern menuntut sistem pengelolaan data yang aman, andal, dan terstruktur. Basis data relasional menjadi tulang punggung dari berbagai sistem informasi, menyimpan data yang sensitif dan penting untuk operasional organisasi. Di sisi lain, data mining menjadi alat penting untuk mengekstrak pola dan informasi strategis dari volume data yang besar. Namun, keandalan hasil data mining sangat dipengaruhi oleh kualitas dan keamanan data yang digunakan. Artikel ini mengkaji integrasi antara sistem keamanan basis data relasional dan penerapan algoritma klasifikasi untuk mendeteksi aktivitas pengguna yang berisiko. Penelitian ini menggunakan pendekatan supervised learning dengan algoritma Decision Tree (C4.5) dan Naive Bayes, yang diuji pada dataset simulasi log aktivitas database dengan kondisi data tidak seimbang. Teknik pra-pemrosesan data, penanganan outlier, dan metode oversampling seperti SMOTE digunakan untuk meningkatkan kualitas model. Hasil menunjukkan bahwa Decision Tree lebih unggul dalam mendeteksi aktivitas mencurigakan dengan nilai F1-Score yang lebih tinggi dibandingkan Naive Bayes, khususnya setelah dilakukan penyesuaian terhadap distribusi kelas. Selain itu, analisis ketahanan terhadap noise memperlihatkan bahwa Naive Bayes memiliki stabilitas yang lebih baik, namun kurang presisi pada deteksi risiko. Temuan ini menegaskan bahwa keamanan data dan pemilihan algoritma yang sesuai sangat berpengaruh terhadap hasil analisis data mining yang akurat dan etis.
Downloads
References
Han, J., Kamber, M., & Pei, J. (2012). Data Mining: Concepts and Techniques (3rd ed.). Morgan Kaufmann.
Silberschatz, A., Korth, H. F., & Sudarshan, S. (2010). Database System Concepts (6th ed.). McGraw-Hill.
Raharjo, S., & Utami, E. (2020). Keamanan Basis Data Relasional. Yogyakarta: Penerbit Andi.
Vassiliadis, P., Simitsis, A., & Skiadopoulos, S. (2002). Conceptual modeling for ETL processes. Proceedings of the 5th ACM International Workshop on Data Warehousing and OLAP, 14–21.
Bertino, E., & Sandhu, R. (2005). Database security: Concepts, approaches, and challenges. IEEE Transactions on Dependable and Secure Computing, 2(1), 2–19.
Chawla, N. V., Bowyer, K. W., Hall, L. O., & Kegelmeyer, W. P. (2002). SMOTE: Synthetic Minority Over-sampling Technique. Journal of Artificial Intelligence Research, 16, 321–357.
Quinlan, J. R. (1993). C4.5: Programs for Machine Learning. Morgan Kaufmann.
Rish, I. (2001). An empirical study of the naive Bayes classifier. IJCAI 2001 Workshop on Empirical Methods in Artificial Intelligence.
Lewis, L. (2021). A Minute on the Internet in 2021 [Infographic]. Statista.
Regulation (EU) 2016/679. General Data Protection Regulation (GDPR). Official Journal of the European Union.
Downloads
Published
How to Cite
Issue
Section
License
Copyright (c) 2025 Muhammad Syahdan , Ahmad Zaelani , Muhamad Fikriansyah , Rizal jafar sidiq , Ilham Abdul Hakim, Hadi Zakaria

This work is licensed under a Creative Commons Attribution 4.0 International License.


















