Đề 10 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 10 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong ngữ cảnh của thuật toán K-means, giá trị `K′ đại diện cho điều gì?
2. Trong khai phá dữ liệu, `dữ liệu nhiễu′ (noisy data) đề cập đến loại dữ liệu nào?
3. Kỹ thuật `khám phá tri thức trong cơ sở dữ liệu′ (KDD) bao gồm khai phá dữ liệu như một bước trong quy trình. Vị trí của khai phá dữ liệu trong KDD là gì?
4. Thuật toán `Apriori′ được sử dụng chủ yếu trong kỹ thuật khai phá dữ liệu nào?
5. Công cụ khai phá dữ liệu nào sau đây là mã nguồn mở và phổ biến?
6. Kỹ thuật `làm sạch dữ liệu′ (data cleaning) trong tiền xử lý dữ liệu bao gồm công việc nào?
7. Thách thức nào sau đây thường gặp phải khi khai phá dữ liệu trên dữ liệu lớn (Big Data)?
8. Đâu là định nghĩa chính xác nhất về Khai phá dữ liệu (Data Mining)?
9. Khi đánh giá mô hình phân loại, `Ma trận nhầm lẫn′ (Confusion Matrix) cung cấp thông tin gì?
10. Phương pháp giảm chiều dữ liệu nào giúp giảm số lượng biến đầu vào bằng cách tạo ra các biến mới là tổ hợp tuyến tính của các biến gốc?
11. Trong quá trình `đánh giá mô hình′ khai phá dữ liệu, độ đo `Độ chính xác′ (Accuracy) thường được sử dụng để làm gì?
12. Thuật toán nào sau đây thuộc nhóm `phân loại′ trong khai phá dữ liệu?
13. Trong khai phá dữ liệu chuỗi thời gian, mục tiêu thường là gì?
14. Trong khai phá dữ liệu đa phương tiện (Multimedia Data Mining), loại dữ liệu nào được xử lý?
15. Trong mô hình CRISP-DM, giai đoạn `Hiểu dữ liệu′ (Data Understanding) bao gồm hoạt động nào?
16. Vấn đề `quá khớp′ (Overfitting) trong khai phá dữ liệu xảy ra khi nào?
17. Trong ngữ cảnh của `Độ tin cậy′ (Confidence) và `Độ nâng′ (Lift) trong luật kết hợp, `Độ nâng′ > 1 cho biết điều gì?
18. Trong khai phá dữ liệu văn bản, kỹ thuật `TF-IDF′ được sử dụng để làm gì?
19. Khi nào thì việc sử dụng `phân tích thành phần chính′ (PCA) trở nên đặc biệt hữu ích trong khai phá dữ liệu?
20. Mục tiêu chính của kỹ thuật `Luật kết hợp′ trong khai phá dữ liệu là gì?
21. Kỹ thuật khai phá dữ liệu nào thường được sử dụng để phân nhóm khách hàng dựa trên hành vi mua sắm tương tự?
22. Đâu là ví dụ về `dữ liệu phi cấu trúc′ thường được khai phá dữ liệu?
23. Phương pháp khai phá dữ liệu nào phù hợp để phát hiện các giao dịch gian lận trong ngân hàng?
24. Phương pháp `cross-validation′ (kiểm định chéo) được sử dụng trong khai phá dữ liệu để làm gì?
25. Sự khác biệt chính giữa `học có giám sát′ (Supervised Learning) và `học không giám sát′ (Unsupervised Learning) trong khai phá dữ liệu là gì?
26. Ưu điểm chính của việc sử dụng khai phá dữ liệu trong kinh doanh là gì?
27. Trong các giai đoạn của quy trình Khai phá dữ liệu, giai đoạn nào tập trung vào việc chuẩn bị dữ liệu thô để sẵn sàng cho phân tích?
28. Đâu là một thách thức đạo đức quan trọng liên quan đến khai phá dữ liệu?
29. Ứng dụng nào sau đây KHÔNG phải là ứng dụng phổ biến của khai phá dữ liệu?
30. Phương pháp khai phá dữ liệu nào thích hợp để dự đoán giá nhà dựa trên các yếu tố như diện tích, vị trí và số phòng ngủ?