A new information theory based algorithm for clustering categorical data
Tác giả: Do Si Truong, Lam Thanh Hien, Nguyen Thanh TungTóm tắt:
In this paper, we review two baseline algorithms for use with categorical data, namely Min-Min Roughness (MMR) and Mean Gain Ratio (MGR), and propose a new algorithm, called Minimum Mean Normalized Variation of Information (MMNVI). MMNVI algorithm uses the Mean Normalized Variation of Information of one attribute concerning another for finding the best clustering attribute, and the entropy of equivalence classes generated by the selected clustering attribute for binary splitting the clustering dataset. Experimental results on real datasets from UCI indicate that the MMNVI algorithm can be used successfully in clustering categorical data. It produces better or equivalent clustering results than the baseline algorithms.
- Một phương pháp dựa trên mạng nơ-ron tích chập một chiều kết hợp tăng cường dữ liệu để khôi phục dữ liệu bị thiếu trong hệ thống giám sát sức khỏe kết cấu cầu
- Nguy cơ tội phạm sử dụng công nghệ deepfake trong giao dịch ngân hàng
- Xây dựng hệ thống giám sát và điều khiển tự động cho trang trại bò sữa sử dụng công nghệ Internet vạn vật
- Kỹ năng số cho người lao động trong bối cảnh chuyển đổi số
- Nguy cơ tội phạm sử dụng công nghệ deepfake trong giao dịch ngân hàng