Đề 9 – Đề thi, câu hỏi trắc nghiệm online Dữ liệu lớn (BigData)

Đề 9 - Đề thi, câu hỏi trắc nghiệm online Dữ liệu lớn (BigData)

1. Yếu tố nào sau đây KHÔNG phải là một trong '5 Vs' thường được dùng để mô tả Big Data?
2. Trong Big Data, thuật ngữ 'A/B testing' (thử nghiệm A/B) thường được sử dụng để làm gì?
3. Trong Big Data, thuật ngữ 'data wrangling' (xử lý dữ liệu) đề cập đến điều gì?
4. Trong ngữ cảnh Big Data, đặc điểm 'Volume' đề cập đến điều gì?
5. Ưu điểm chính của việc sử dụng NoSQL so với cơ sở dữ liệu quan hệ (RDBMS) trong Big Data là gì?
6. Công cụ nào sau đây thường được sử dụng để thu thập dữ liệu từ các nguồn trực tuyến (web scraping) cho Big Data?
7. Vấn đề lớn nhất mà Big Data đặt ra cho các tổ chức liên quan đến quyền riêng tư là gì?
8. Trong ngữ cảnh Big Data, 'data governance' (quản trị dữ liệu) đề cập đến điều gì?
9. Khi nào thì việc sử dụng kiến trúc Lambda (Lambda architecture) là phù hợp?
10. Trong Big Data, 'data lineage' (dòng dõi dữ liệu) đề cập đến điều gì?
11. Trong bối cảnh Big Data, 'feature engineering' (kỹ thuật đặc trưng) là gì?
12. Công cụ nào sau đây thường được sử dụng để quản lý cluster Hadoop?
13. Một trong những thách thức chính của việc sử dụng Big Data trong lĩnh vực tài chính là gì?
14. Thuật ngữ 'data mining' (khai thác dữ liệu) trong Big Data đề cập đến điều gì?
15. Công cụ nào sau đây thường được sử dụng để quản lý và điều phối các công việc (workflows) trong Hadoop?
16. Một trong những lợi ích chính của việc sử dụng điện toán đám mây (cloud computing) cho Big Data là gì?
17. Trong Big Data, thuật ngữ 'data federation' (liên kết dữ liệu) đề cập đến điều gì?
18. Công cụ nào sau đây được sử dụng để chuyển dữ liệu giữa Hadoop và các cơ sở dữ liệu quan hệ?
19. Trong Big Data, thuật ngữ 'schema-on-read' có nghĩa là gì?
20. Hệ thống nào sau đây được thiết kế để xử lý dữ liệu theo thời gian thực (real-time data processing) trong Big Data?
21. Spark khác biệt so với Hadoop MapReduce chủ yếu ở điểm nào?
22. Công cụ nào sau đây thường được sử dụng để thu thập, xử lý và phân tích log dữ liệu (log data) trong Big Data?
23. Công cụ nào sau đây thường được sử dụng để trực quan hóa dữ liệu Big Data?
24. Hadoop chủ yếu được thiết kế để giải quyết vấn đề nào trong Big Data?
25. Ứng dụng nào sau đây KHÔNG phải là một ứng dụng phổ biến của Big Data?
26. Trong Big Data, thuật ngữ 'data lake' (hồ dữ liệu) dùng để chỉ điều gì?
27. Trong ngữ cảnh Big Data và Machine Learning, kỹ thuật nào giúp giảm số lượng chiều dữ liệu trong khi vẫn giữ lại thông tin quan trọng?
28. Tại sao việc lấy mẫu dữ liệu (data sampling) lại quan trọng trong Big Data?
29. Trong Big Data, 'data enrichment' (làm giàu dữ liệu) là gì?
30. Một thách thức lớn trong việc áp dụng Big Data vào lĩnh vực y tế là gì?