Đề 4 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 4 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong bài toán phân loại, `confusion matrix′ (ma trận nhầm lẫn) cung cấp thông tin gì?
2. Đâu là một công cụ khai phá dữ liệu mã nguồn mở phổ biến?
3. ROC curve (đường cong ROC) thường được sử dụng để đánh giá hiệu suất của mô hình nào?
4. Đâu là một thách thức lớn khi khai phá dữ liệu từ mạng xã hội?
5. Kỹ thuật `dimensionality reduction′ (giảm chiều dữ liệu) có lợi ích gì trong khai phá dữ liệu?
6. Trong khai phá dữ liệu, `bias-variance tradeoff′ đề cập đến sự đánh đổi giữa yếu tố nào?
7. Thuật toán Apriori được sử dụng trong lĩnh vực khai phá dữ liệu nào?
8. Phương pháp `principal component analysis′ (PCA) là một ví dụ của kỹ thuật nào?
9. Mục tiêu của `anomaly detection′ (phát hiện bất thường) trong khai phá dữ liệu là gì?
10. Đâu là một ví dụ về ứng dụng của khai phá dữ liệu trong lĩnh vực y tế?
11. Trong khai phá dữ liệu chuỗi thời gian, `ARIMA′ là mô hình được sử dụng để làm gì?
12. Trong thuật toán K-means, giá trị `K′ đại diện cho điều gì?
13. Kỹ thuật `feature selection′ (lựa chọn thuộc tính) trong khai phá dữ liệu nhằm mục đích gì?
14. Phương pháp khai phá luật kết hợp (association rule mining) thường được sử dụng để giải quyết bài toán nào?
15. Trong mô hình cây quyết định (decision tree), `entropy′ được sử dụng để làm gì?
16. Độ đo `precision′ trong đánh giá mô hình phân loại đo lường điều gì?
17. Thuật toán nào sau đây KHÔNG thuộc nhóm thuật toán phân cụm?
18. Kỹ thuật `bagging′ và `boosting′ thuộc nhóm phương pháp học máy nào?
19. Đâu là nhược điểm chính của thuật toán K-Nearest Neighbors (KNN)?
20. Phương pháp `cross-validation′ (kiểm định chéo) được sử dụng để làm gì trong quá trình xây dựng mô hình khai phá dữ liệu?
21. Trong khai phá dữ liệu, `overfitting′ đề cập đến vấn đề gì?
22. Trong quá trình tiền xử lý dữ liệu, kỹ thuật `chuẩn hóa dữ liệu′ (data normalization) nhằm mục đích gì?
23. Kỹ thuật khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm?
24. Đâu là một ví dụ về `semi-supervised learning′ (học bán giám sát) trong khai phá dữ liệu?
25. Mục đích chính của việc `visualizing data mining results′ (trực quan hóa kết quả khai phá dữ liệu) là gì?
26. Trong khai phá dữ liệu web, `web usage mining′ tập trung vào việc phân tích dữ liệu nào?
27. Trong thuật toán DBSCAN, tham số `epsilon′ (ε) xác định điều gì?
28. Kỹ thuật `one-hot encoding′ được sử dụng để xử lý loại dữ liệu nào trong khai phá dữ liệu?
29. Đâu là mục tiêu chính của khai phá dữ liệu?
30. Trong khai phá dữ liệu văn bản, `TF-IDF′ được sử dụng để làm gì?