Đề 13 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 13 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Phương pháp khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm?
2. Trong khai phá dữ liệu, `mô hình hóa′ (modeling) là giai đoạn nào?
3. Phương pháp nào sau đây thuộc nhóm `học không giám sát′ (Unsupervised Learning) trong khai phá dữ liệu?
4. Mục tiêu chính của kỹ thuật `giảm chiều dữ liệu′ (Dimensionality Reduction) trong tiền xử lý dữ liệu là gì?
5. Ứng dụng nào sau đây KHÔNG phải là ứng dụng phổ biến của khai phá dữ liệu?
6. Độ đo `F1-score′ là trung bình điều hòa của độ đo nào?
7. Trong ngữ cảnh khai phá dữ liệu không gian, loại dữ liệu nào được xử lý chủ yếu?
8. Trong khai phá dữ liệu web, `web usage mining′ (khai phá sử dụng web) tập trung vào việc phân tích dữ liệu nào?
9. Ý nghĩa của `lift′ trong khai thác luật kết hợp là gì?
10. Phương pháp `ensemble learning′ (học tập kết hợp) trong khai phá dữ liệu là gì?
11. Mục tiêu của việc `diễn giải kết quả` (interpretation) sau khi khai phá dữ liệu là gì?
12. Trong thuật toán K-means, `K′ đại diện cho điều gì?
13. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là gì?
14. Loại tấn công bảo mật nào có thể xảy ra khi khai thác dữ liệu cá nhân mà không tuân thủ quy định?
15. Trong ngữ cảnh khai phá dữ liệu văn bản, `TF-IDF′ được sử dụng để làm gì?
16. Độ đo `độ chính xác′ (Accuracy) trong đánh giá mô hình phân loại được tính như thế nào?
17. Điểm khác biệt chính giữa khai phá dữ liệu và thống kê truyền thống là gì?
18. Kỹ thuật `feature scaling′ (tỷ lệ hóa thuộc tính) trong tiền xử lý dữ liệu nhằm mục đích gì?
19. Thuật toán DBSCAN được sử dụng cho mục đích gì trong khai phá dữ liệu?
20. Vấn đề `quá khớp′ (Overfitting) trong mô hình học máy xảy ra khi nào?
21. Loại dữ liệu nào sau đây thường KHÔNG phù hợp để áp dụng thuật toán K-means?
22. Kỹ thuật `làm sạch dữ liệu′ (Data Cleaning) trong tiền xử lý dữ liệu bao gồm những công việc chính nào?
23. Độ đo `recall′ (độ phủ) trong đánh giá mô hình phân loại được tính như thế nào?
24. Trong khai thác luật kết hợp, độ đo `độ tin cậy′ (Confidence) thể hiện điều gì?
25. Phương pháp `cross-validation′ (kiểm định chéo) được sử dụng để làm gì trong quá trình xây dựng mô hình khai phá dữ liệu?
26. Trong quy trình khai phá dữ liệu, giai đoạn nào thường chiếm nhiều thời gian và công sức nhất?
27. Thuật toán nào sau đây thuộc nhóm thuật toán phân loại trong khai phá dữ liệu?
28. Trong bối cảnh khai phá dữ liệu lớn (Big Data), thách thức chính nào thường gặp phải?
29. Trong khai phá dữ liệu chuỗi thời gian, mục tiêu chính thường là gì?
30. Khái niệm `data warehouse′ (kho dữ liệu) trong khai phá dữ liệu dùng để chỉ điều gì?