Đề 2 – Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

Đề 2 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Ưu điểm chính của việc sử dụng `In-memory processing′ (Xử lý trong bộ nhớ) trong Dữ liệu lớn là gì?
2. Thuật ngữ `Data Wrangling′ (Chuẩn bị dữ liệu) trong Dữ liệu lớn bao gồm các công việc chính nào?
3. Công cụ nào sau đây thường được sử dụng để trực quan hóa dữ liệu lớn?
4. Lợi ích chính của việc sử dụng điện toán đám mây (Cloud Computing) trong Dữ liệu lớn là gì?
5. Trong ngữ cảnh bảo mật Dữ liệu lớn, `Data Masking′ (Che giấu dữ liệu) được sử dụng để làm gì?
6. Khái niệm `Scalability′ (Khả năng mở rộng) trong Dữ liệu lớn có nghĩa là gì?
7. Phương pháp `Data Federation′ (Liên kết dữ liệu) trong Dữ liệu lớn có nghĩa là gì?
8. Ứng dụng nào sau đây KHÔNG phải là một ứng dụng điển hình của Dữ liệu lớn?
9. Khái niệm `Data Silos′ (Kho dữ liệu cô lập) gây ra vấn đề gì trong Dữ liệu lớn?
10. Điểm khác biệt chính giữa `Data Warehouse′ (Kho dữ liệu) truyền thống và `Data Lake′ (Hồ dữ liệu) là gì?
11. Công cụ nào sau đây thường được dùng để truy vấn và phân tích dữ liệu lớn trong Hadoop?
12. Thách thức về `Volume′ (Khối lượng) trong Dữ liệu lớn chủ yếu liên quan đến vấn đề gì?
13. Nguyên tắc `Polyglot Persistence′ trong Dữ liệu lớn khuyến khích điều gì?
14. Phương pháp `Data Mining′ (Khai phá dữ liệu) trong Dữ liệu lớn chủ yếu nhằm mục đích gì?
15. Công nghệ nào sau đây thường được sử dụng để xử lý dữ liệu lớn theo thời gian thực (real-time processing)?
16. Thách thức `Veracity′ (Tính xác thực) trong Dữ liệu lớn liên quan đến vấn đề gì?
17. Trong lĩnh vực Dữ liệu lớn, `Data Governance′ (Quản trị dữ liệu) tập trung vào điều gì?
18. Đặc điểm nào sau đây KHÔNG phải là một trong `5Vs′ thường được dùng để mô tả Dữ liệu lớn?
19. Hệ thống nào sau đây thường được sử dụng để lưu trữ và xử lý dữ liệu lớn phân tán?
20. Trong ngữ cảnh Dữ liệu lớn, `Real-time Analytics′ (Phân tích thời gian thực) mang lại lợi ích gì?
21. Trong kiến trúc Dữ liệu lớn, `Message Queue′ (Hàng đợi tin nhắn) thường được dùng để làm gì?
22. Trong bối cảnh Dữ liệu lớn, `ETL′ (Extract, Transform, Load) thường được thay thế bằng quy trình nào linh hoạt hơn?
23. Kiến trúc `Lambda Architecture′ trong Dữ liệu lớn được thiết kế để xử lý loại hình phân tích nào?
24. Phương pháp `Data Sampling′ (Lấy mẫu dữ liệu) được sử dụng trong Dữ liệu lớn khi nào?
25. Trong phân tích Dữ liệu lớn, `Machine Learning′ (Học máy) được sử dụng để làm gì?
26. Loại dữ liệu nào sau đây KHÔNG thuộc `Variety′ (Tính đa dạng) trong đặc điểm của Dữ liệu lớn?
27. Yếu tố nào sau đây KHÔNG phải là một thách thức lớn đối với Dữ liệu lớn?
28. Thuật ngữ `Data Lake′ (Hồ dữ liệu) trong Dữ liệu lớn dùng để chỉ điều gì?
29. Công nghệ NoSQL thường được sử dụng trong Dữ liệu lớn để giải quyết vấn đề gì?
30. Công cụ nào sau đây KHÔNG phải là một nền tảng phân tích Dữ liệu lớn phổ biến trên đám mây?