Đề 8 – Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

Đề 8 - Bài tập, đề thi trắc nghiệm online Dữ liệu lớn (BigData)

1. Trong kiến trúc Kappa (Kappa Architecture) cho Dữ liệu lớn, dữ liệu được xử lý chủ yếu theo mô hình nào?
2. Loại dữ liệu nào sau đây được xem là `phi cấu trúc′ (unstructured data)?
3. Khía cạnh `Velocity′ (Tốc độ) của Dữ liệu lớn đề cập đến điều gì?
4. Trong bối cảnh Dữ liệu lớn, thuật ngữ `data governance′ (quản trị dữ liệu) có vai trò quan trọng nhất trong việc đảm bảo điều gì?
5. Công nghệ MapReduce hoạt động theo mô hình lập trình nào?
6. Trong bối cảnh bảo mật Dữ liệu lớn, kỹ thuật `data masking′ (che dấu dữ liệu) được sử dụng để làm gì?
7. Trong ngữ cảnh Dữ liệu lớn, thuật ngữ `in-memory processing′ (xử lý trong bộ nhớ) mang lại lợi ích chính nào?
8. Công nghệ nào sau đây thường được sử dụng để thu thập và chuyển dữ liệu luồng từ nhiều nguồn khác nhau vào Hadoop?
9. Trong mô hình MapReduce, giai đoạn `Reduce′ có chức năng chính là gì?
10. Hadoop Distributed File System (HDFS) được thiết kế chủ yếu để giải quyết vấn đề gì trong Dữ liệu lớn?
11. Thuật ngữ `schema-on-read′ thường được liên kết với loại kho dữ liệu nào trong Dữ liệu lớn?
12. Công cụ nào sau đây thường được dùng để truy vấn và phân tích dữ liệu trong Hadoop Data Lake bằng ngôn ngữ SQL-like?
13. Công nghệ nào sau đây KHÔNG thuộc hệ sinh thái Hadoop?
14. Trong mô hình CAP theorem, hệ thống Dữ liệu lớn phân tán thường ưu tiên tính nhất quán (Consistency) và khả năng sẵn sàng (Availability) hơn là tính phân vùng (Partition tolerance).
15. Thách thức chính của `Veracity′ (Độ xác thực) trong Dữ liệu lớn là gì?
16. Trong kiến trúc Lambda (Lambda Architecture) cho Dữ liệu lớn, lớp `batch layer′ (lớp xử lý hàng loạt) thường sử dụng công nghệ nào?
17. Công nghệ blockchain có thể được ứng dụng trong Dữ liệu lớn để giải quyết vấn đề nào?
18. Loại hình phân tích dữ liệu nào tập trung vào việc dự đoán xu hướng và kết quả trong tương lai?
19. Thuật ngữ `Data Lake′ (Hồ dữ liệu) trong bối cảnh Dữ liệu lớn dùng để chỉ điều gì?
20. Đặc điểm nào sau đây KHÔNG phải là một trong `5Vs′ thường được dùng để mô tả Dữ liệu lớn?
21. Ứng dụng của Dữ liệu lớn trong lĩnh vực y tế có thể bao gồm điều gì?
22. Ưu điểm của việc sử dụng công nghệ đám mây (cloud computing) cho Dữ liệu lớn là gì?
23. Khái niệm `data wrangling′ (chuẩn bị dữ liệu) trong Dữ liệu lớn bao gồm những công việc chính nào?
24. Thách thức về `Variety′ (Đa dạng) của Dữ liệu lớn liên quan đến điều gì?
25. Trong bối cảnh Dữ liệu lớn, `Data Mining′ (Khai phá dữ liệu) chủ yếu tập trung vào điều gì?
26. Công cụ nào sau đây thường được sử dụng để xử lý luồng dữ liệu (stream processing) trong Dữ liệu lớn?
27. Yếu tố nào sau đây KHÔNG phải là động lực chính thúc đẩy sự phát triển của Dữ liệu lớn?
28. Ứng dụng nào sau đây KHÔNG phải là một ứng dụng phổ biến của Dữ liệu lớn?
29. Ưu điểm chính của cơ sở dữ liệu NoSQL so với cơ sở dữ liệu quan hệ truyền thống trong xử lý Dữ liệu lớn là gì?
30. Công cụ nào sau đây thường được sử dụng để trực quan hóa dữ liệu lớn?