Đề 9 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 9 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu, `cross-validation′ (kiểm định chéo) được sử dụng để làm gì?
2. Kỹ thuật `Data Mining′ thường được áp dụng trong lĩnh vực y tế để làm gì?
3. Trong khai phá dữ liệu, `dữ liệu nhiễu′ (noisy data) đề cập đến loại dữ liệu nào?
4. Trong khai phá dữ liệu, phương pháp nào thường được sử dụng để xử lý dữ liệu bị thiếu giá trị (missing values)?
5. Trong khai phá dữ liệu, thuật ngữ `k-NN′ là viết tắt của cụm từ nào?
6. Trong khai phá dữ liệu, `outlier′ (giá trị ngoại lai) là gì?
7. Kỹ thuật nào trong khai phá dữ liệu thường được sử dụng để dự đoán giá trị của một biến số mục tiêu dựa trên một hoặc nhiều biến số đầu vào?
8. Đâu là một ứng dụng phổ biến của khai phá dữ liệu trong lĩnh vực thương mại điện tử?
9. Mục tiêu chính của việc khai phá dữ liệu là gì?
10. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để giảm số chiều dữ liệu, giúp đơn giản hóa mô hình và tăng tốc độ xử lý?
11. Đâu là một thách thức về đạo đức trong ứng dụng khai phá dữ liệu?
12. Thuật toán K-means thường được sử dụng trong kỹ thuật khai phá dữ liệu nào?
13. Trong khai phá dữ liệu, `mô hình hộp đen′ (black box model) có đặc điểm gì?
14. Phương pháp `Principal Component Analysis′ (PCA) được sử dụng trong kỹ thuật khai phá dữ liệu nào?
15. Thuật toán `Apriori′ thường được sử dụng trong kỹ thuật khai phá dữ liệu nào?
16. Phương pháp `Decision Tree′ (Cây quyết định) thuộc loại kỹ thuật khai phá dữ liệu nào?
17. Trong khai phá dữ liệu văn bản, `TF-IDF′ được sử dụng để làm gì?
18. Trong khai phá dữ liệu, phương pháp `luật kết hợp′ (association rule mining) thường được sử dụng để làm gì?
19. Độ đo `precision′ (độ chính xác) trong đánh giá mô hình phân lớp được tính như thế nào?
20. Độ đo `recall′ (độ phủ) trong đánh giá mô hình phân lớp được tính như thế nào?
21. Trong quá trình khai phá dữ liệu, bước nào thường được thực hiện đầu tiên?
22. Đâu là thách thức lớn nhất khi khai phá dữ liệu từ các nguồn dữ liệu lớn và phức tạp (Big Data)?
23. Trong khai phá dữ liệu chuỗi thời gian, phương pháp `ARIMA′ thường được dùng để làm gì?
24. Trong mô hình hóa dữ liệu, hiện tượng `overfitting′ (quá khớp) xảy ra khi nào?
25. Phương pháp `Naive Bayes′ thường được sử dụng cho bài toán khai phá dữ liệu nào?
26. Trong khai phá dữ liệu, `đánh giá mô hình′ (model evaluation) có vai trò quan trọng như thế nào?
27. Trong quá trình tiền xử lý dữ liệu, `chuẩn hóa dữ liệu′ (data normalization) nhằm mục đích chính là gì?
28. Phương pháp khai phá dữ liệu nào tập trung vào việc tìm ra các nhóm đối tượng tương tự nhau trong một tập dữ liệu, mà không cần biết trước các nhóm này?
29. Phương pháp `Support Vector Machine′ (SVM) chủ yếu được sử dụng cho bài toán khai phá dữ liệu nào?
30. Kỹ thuật `Feature Selection′ (Chọn lọc đặc trưng) trong tiền xử lý dữ liệu có mục đích gì?