Đề 7 – Đề thi, câu hỏi trắc nghiệm online Dữ liệu lớn (BigData)

Đề 7 - Đề thi, câu hỏi trắc nghiệm online Dữ liệu lớn (BigData)

1. Ứng dụng nào sau đây là một ví dụ về việc sử dụng Big Data trong lĩnh vực y tế?
2. Data warehouse là gì?
3. Một trong những thách thức về bảo mật dữ liệu lớn là gì?
4. Giá trị (Value) trong Big Data thể hiện điều gì?
5. ETL (Extract, Transform, Load) là gì?
6. Công cụ nào sau đây thường được sử dụng để truy vấn và phân tích dữ liệu trong Hadoop?
7. NoSQL là gì?
8. Thuật ngữ 'Variety' trong Big Data liên quan đến khía cạnh nào?
9. MapReduce là gì?
10. Trong bối cảnh Big Data, thuật ngữ 'data wrangling' (hoặc 'data munging') đề cập đến điều gì?
11. Data governance là gì?
12. Data lake là gì?
13. Data virtualization là gì?
14. Yếu tố 'Velocity' trong Big Data mô tả điều gì?
15. Trong lĩnh vực tài chính, Big Data được sử dụng để làm gì?
16. Thách thức lớn nhất khi làm việc với Big Data là gì?
17. Trong ngữ cảnh Big Data, đặc điểm 'Volume' đề cập đến điều gì?
18. Trong Big Data, 'Veracity' đề cập đến khía cạnh nào của dữ liệu?
19. Data mining là gì?
20. Sự khác biệt chính giữa Data Lake và Data Warehouse là gì?
21. Trong Big Data, thuật ngữ 'schema-on-read' có nghĩa là gì?
22. Khi nào nên sử dụng Data Lake thay vì Data Warehouse?
23. Ví dụ nào sau đây là một loại cơ sở dữ liệu NoSQL?
24. Spark là gì?
25. Công nghệ nào sau đây thường được sử dụng để lưu trữ và xử lý dữ liệu lớn phân tán?
26. Công cụ nào sau đây thường được sử dụng để trực quan hóa dữ liệu lớn?
27. Ưu điểm chính của việc sử dụng Spark so với MapReduce là gì?
28. Trong lĩnh vực bán lẻ, Big Data được sử dụng để làm gì?
29. Machine learning được sử dụng trong Big Data để làm gì?
30. HDFS (Hadoop Distributed File System) là gì?