Đề 11 – Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

Đề 11 - Bài tập, đề thi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu đa phương tiện, dữ liệu nào KHÔNG thuộc loại dữ liệu đa phương tiện?
2. Độ đo `độ chính xác′ (accuracy) trong phân loại thường được tính bằng:
3. Trong kiến trúc dữ liệu lớn, `Hadoop Distributed File System′ (HDFS) được sử dụng để:
4. Trong khai phá dữ liệu, `độ đo hỗ trợ` (support) thường được sử dụng trong thuật toán nào?
5. Trong khai phá dữ liệu chuỗi thời gian, mục tiêu chính thường là:
6. Trong khai phá dữ liệu, `mô hình hộp đen′ (black box model) thường được nhắc đến khi nói về thuật toán nào?
7. Trong quy trình khai phá dữ liệu, giai đoạn nào tập trung vào việc làm sạch và chuyển đổi dữ liệu?
8. Khi mô hình phân loại dự đoán sai một mẫu dương tính là âm tính, đây được gọi là lỗi loại nào?
9. Độ đo `F1-score′ là trung bình điều hòa của độ đo nào?
10. Khi nào nên sử dụng phương pháp `phân tích thành phần chính′ (PCA)?
11. Phương pháp xử lý dữ liệu ngoại lai (outlier) nào sau đây có thể làm mất thông tin?
12. Phương pháp `gradient boosting′ thuộc loại thuật toán học máy nào?
13. Đâu là thách thức lớn nhất khi khai phá dữ liệu từ mạng xã hội?
14. Phương pháp `cross-validation′ (kiểm định chéo) được sử dụng để làm gì trong quá trình xây dựng mô hình khai phá dữ liệu?
15. Kỹ thuật giảm chiều dữ liệu (dimensionality reduction) có vai trò gì trong khai phá dữ liệu?
16. Khai phá dữ liệu (Data Mining) được định nghĩa chính xác nhất là:
17. Trong ngữ cảnh khai phá dữ liệu, `overfitting′ (quá khớp) đề cập đến vấn đề gì?
18. Khái niệm `confidence′ (độ tin cậy) trong khai thác luật kết hợp đo lường điều gì?
19. Trong khai phá dữ liệu văn bản, `TF-IDF′ được sử dụng để:
20. Phương pháp `bootstrap aggregating′ (bagging) trong học máy nhằm mục đích:
21. Trong mô hình cây quyết định, `entropy′ (entropi) được sử dụng để:
22. Thuật toán phân cụm (Clustering) được sử dụng trong khai phá dữ liệu nhằm mục đích:
23. Trong khai phá dữ liệu không gian, kỹ thuật nào thường được sử dụng để tìm kiếm các cụm có hình dạng bất kỳ?
24. Ứng dụng nào sau đây KHÔNG phải là ứng dụng của khai phá dữ liệu?
25. Thuật toán `Support Vector Machine′ (SVM) hoạt động tốt nhất trong bài toán nào?
26. Trong ngữ cảnh khai phá web, `web usage mining′ (khai phá sử dụng web) tập trung vào việc phân tích dữ liệu nào?
27. Mục tiêu của `feature scaling′ (tỷ lệ hóa thuộc tính) trong tiền xử lý dữ liệu là gì?
28. Phương pháp khai phá dữ liệu nào thường được sử dụng để dự đoán xu hướng bán hàng trong tương lai?
29. Điểm khác biệt chính giữa khai phá dữ liệu và thống kê truyền thống là gì?
30. Trong thuật toán K-Means, giá trị `K′ đại diện cho điều gì?