Đề 3 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 3 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong quá trình khai phá dữ liệu, bước nào sau đây thường được thực hiện ĐẦU TIÊN?
2. Ứng dụng của khai phá dữ liệu trong lĩnh vực y tế KHÔNG bao gồm:
3. Mục tiêu chính của `data visualization′ (trực quan hóa dữ liệu) trong khai phá dữ liệu là:
4. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là:
5. Kỹ thuật nào sau đây giúp giảm số chiều dữ liệu trong khai phá dữ liệu, đồng thời giữ lại thông tin quan trọng nhất?
6. Trong khai phá dữ liệu, `Precision′ (Độ chính xác dương) được tính bằng:
7. Trong khai phá dữ liệu, `luật kết hợp′ (association rule) thường có dạng:
8. Trong khai phá dữ liệu, `feature scaling′ (tỷ lệ hóa thuộc tính) thường được áp dụng để:
9. Kỹ thuật `Naive Bayes′ thường được sử dụng cho bài toán nào trong khai phá dữ liệu?
10. Thuật toán `Support Vector Machine′ (SVM) thường được sử dụng cho bài toán nào?
11. Trong khai phá dữ liệu, `RMSE′ (Root Mean Squared Error) là độ đo hiệu suất cho mô hình:
12. Phương pháp nào sau đây KHÔNG phải là kỹ thuật giảm chiều dữ liệu?
13. Khi dữ liệu chứa nhiều giá trị ngoại lai (outliers), thuật toán phân cụm nào sau đây ít bị ảnh hưởng nhất?
14. Trong khai phá dữ liệu, `bias-variance tradeoff′ (đánh đổi giữa độ chệch và phương sai) đề cập đến:
15. Quá trình `feature engineering′ (kỹ thuật tạo đặc trưng) trong khai phá dữ liệu nhằm mục đích:
16. Trong khai phá dữ liệu, `cross-validation′ (kiểm định chéo) được sử dụng để:
17. Thuật toán Apriori được sử dụng chủ yếu trong lĩnh vực nào của khai phá dữ liệu?
18. Trong khai phá dữ liệu, khái niệm `entropy′ thường được sử dụng trong thuật toán nào?
19. Trong ngữ cảnh khai phá dữ liệu web, `web usage mining′ (khai phá sử dụng web) tập trung vào:
20. Đánh giá mô hình phân loại trong khai phá dữ liệu, độ đo `Độ chính xác′ (Accuracy) được tính bằng:
21. Thuật toán `Random Forest′ là một dạng của:
22. Ứng dụng nào sau đây KHÔNG phải là ứng dụng điển hình của khai phá dữ liệu?
23. Kỹ thuật nào sau đây thường được sử dụng để xử lý dữ liệu bị thiếu (missing values)?
24. Trong khai phá dữ liệu, `overfitting′ (quá khớp) xảy ra khi:
25. Trong khai phá dữ liệu, `Lift′ là một độ đo quan trọng trong:
26. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm?
27. Phương pháp `Decision Tree′ (Cây quyết định) thuộc loại mô hình khai phá dữ liệu nào?
28. Phương pháp nào sau đây KHÔNG thuộc nhóm kỹ thuật tiền xử lý dữ liệu trong khai phá dữ liệu?
29. Phương pháp `K-Means′ trong khai phá dữ liệu thuộc loại kỹ thuật:
30. Độ đo `Recall′ (Độ nhớ) trong đánh giá mô hình phân loại được tính bằng: