Đề 7 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 7 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Khái niệm `feature selection′ (lựa chọn thuộc tính) trong khai phá dữ liệu nhằm mục đích gì?
2. Độ đo `độ chính xác′ (accuracy) thường được sử dụng để đánh giá hiệu suất của mô hình nào trong khai phá dữ liệu?
3. Kỹ thuật `cross-validation′ (kiểm định chéo) được sử dụng để làm gì trong khai phá dữ liệu?
4. Trong ngữ cảnh khai phá dữ liệu lớn (big data mining), thách thức chính thường liên quan đến điều gì?
5. Mục đích của việc `rời rạc hóa dữ liệu′ (data discretization) là gì?
6. Phương pháp nào sau đây KHÔNG thuộc nhóm phương pháp phân cụm?
7. Thuật ngữ `KDD′ thường được sử dụng thay thế cho `Khai phá dữ liệu′. KDD là viết tắt của cụm từ nào?
8. Phương pháp nào sau đây thuộc nhóm `học có giám sát′ (supervised learning) trong khai phá dữ liệu?
9. Kỹ thuật `bootstrapping′ thường được sử dụng trong khai phá dữ liệu để làm gì?
10. Kỹ thuật nào sau đây có thể được sử dụng để giảm số chiều dữ liệu trong khai phá dữ liệu?
11. Kỹ thuật `anomaly detection′ (phát hiện bất thường) được sử dụng để làm gì trong khai phá dữ liệu?
12. Trong khai phá dữ liệu, `luật kết hợp′ (association rule) thường được sử dụng để làm gì?
13. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để phân nhóm các đối tượng tương tự nhau thành các cụm?
14. Phương pháp khai phá dữ liệu nào tập trung vào việc dự đoán giá trị số cho một biến mục tiêu dựa trên các biến đầu vào?
15. Mục tiêu chính của khai phá dữ liệu là gì?
16. Trong khai phá dữ liệu không gian (spatial data mining), loại dữ liệu nào được xử lý chính?
17. Độ đo `recall′ (độ phủ) trong đánh giá mô hình phân loại được tính bằng công thức nào?
18. Thuật toán Apriori được sử dụng chủ yếu trong loại khai phá dữ liệu nào?
19. Bước nào sau đây KHÔNG phải là một bước điển hình trong quy trình khai phá dữ liệu?
20. Độ đo `precision′ (độ chuẩn xác) trong đánh giá mô hình phân loại được tính bằng công thức nào?
21. Trong khai phá dữ liệu, `support′ (độ hỗ trợ) của một luật kết hợp đo lường điều gì?
22. Phương pháp `gradient descent′ (hạ gradient) thường được sử dụng để làm gì trong khai phá dữ liệu?
23. Trong khai phá dữ liệu, `ensemble methods′ (phương pháp tập hợp) thường được sử dụng để làm gì?
24. Trong khai phá dữ liệu chuỗi thời gian (time series data mining), mục tiêu chính thường là gì?
25. Trong khai phá dữ liệu web, `web usage mining′ (khai phá sử dụng web) tập trung vào việc phân tích dữ liệu nào?
26. Trong khai phá dữ liệu, `overfitting′ (quá khớp) xảy ra khi nào?
27. Trong khai phá dữ liệu đa phương tiện (multimedia data mining), loại dữ liệu nào KHÔNG được xử lý?
28. Trong tiền xử lý dữ liệu, kỹ thuật `chuẩn hóa dữ liệu′ (data normalization) nhằm mục đích gì?
29. Thuật ngữ `lift′ trong luật kết hợp đo lường điều gì?
30. Trong khai phá dữ liệu văn bản (text mining), kỹ thuật `TF-IDF′ thường được sử dụng để làm gì?