Thuật toán khai thác tập hữu ích cao dựa trên di truyền với đột biến xếp hạng
Tác giả: Phạm Đức Thành, Lê Thị Minh NguyệnTóm tắt:
Khai thác độ hữu ích là nghiên cứu khai thác tập mục có lợi từ cơ sở dữ liệu giao dịch. Đây là phương pháp khai thác tập phổ biến dựa trên độ hữu ích để tìm tập mục phù hợp với sở thích của người dùng. Những nghiên cứu gần đây về khai thác các tập mục hữu ích cao (HUIs) từ cơ sở dữ liệu (CSDL) phải đối mặt với hai thách thức lớn, đó là không gian tìm kiếm theo cấp số nhân và ngưỡng hữu ích tối thiểu phụ thuộc vào CSDL. Không gian tìm kiếm vô cùng lớn khi số lượng các mục riêng biệt và kích thước của CSDL lớn. Các nhà phân tích phải chỉ định các ngưỡng hữu ích tối thiểu để phù hợp với những công việc khai thác của họ, mặc dù có thể họ không có kiến thức liên quan đến CSDL mà họ đang làm. Hơn nữa, thuật toán khai thác độ hữu ích chỉ hỗ trợ tập mục mang giá trị dương. Để tránh những vấn đề này, bài viết rình bày hai cách tiếp cận để khai thác HUI có chứa mục giá trị âm từ CSDL giao dịch: có hoặc không có chỉ định ngưỡng hữu ích tối thiểu thông qua thuật giải di truyền với đột biến được xếp hạng. Theo sự tìm hiểu của chúng tôi, đây là nghiên cứu đầu tiên trong khai thác HUI với các giá trị mang mục âm từ CSDL giao dịch sử dụng thuật giải di truyền. Kết quả thử nghiệm cho thấy các phương pháp tiếp cận được mô tả trong bài viết này đạt được hiệu suất tốt hơn về khả năng mở rộng và tính hiệu quả.
- Tác động của nguồn vốn hỗ trợ phát triển chính thức đến lượng khí thải CO2 tại các quốc gia Châu Á : tiếp cận theo ngưỡng đô thị hóa
- Tác động của thực hiện các yếu tố ESG tới hiệu quả hoạt động của ngân hàng thương mại tại khu vực châu Á
- Kinh nghiệm phát triển nền “kinh tế bạc” của Trung Quốc trong bối cảnh già hoá dân số và bài học cho Việt Nam
- Phát triển kinh tế tư nhân ở Việt Nam : đổi mới từ nhận thức đến thực tiễn
- Ứng dụng công nghệ chuỗi khối (Blockchain) trong đổi mới sáng tạo tài chính