[Cánh diều] Trắc nghiệm Khoa học máy tính 12 bài 3: Giới thiệu về khoa học dữ liệu (tiếp theo)

[Cánh diều] Trắc nghiệm Khoa học máy tính 12 bài 3: Giới thiệu về khoa học dữ liệu (tiếp theo)

1. Trong quy trình làm việc của Khoa học dữ liệu, giai đoạn Data Cleaning (Làm sạch dữ liệu) chủ yếu tập trung vào hoạt động nào?
2. Yếu tố nào sau đây KHÔNG phải là một bước trong quy trình Khoa học dữ liệu điển hình?
3. Yếu tố nào là quan trọng nhất để đảm bảo tính Veracity (Tính xác thực) của dữ liệu trong Khoa học dữ liệu?
4. Khái niệm Data Visualization (Trực quan hóa dữ liệu) trong Khoa học dữ liệu có vai trò chính là gì?
5. Một nhà khoa học dữ liệu sử dụng biểu đồ phân tán (scatter plot) để:
6. Yếu tố nào dưới đây là quan trọng nhất khi lựa chọn thuật toán học máy cho một bài toán Khoa học dữ liệu cụ thể?
7. Yếu tố nào sau đây KHÔNG thuộc về các thách thức chính mà các nhà khoa học dữ liệu thường đối mặt khi xử lý dữ liệu lớn?
8. Khi thực hiện Feature Selection (Lựa chọn đặc trưng) trong Khoa học dữ liệu, mục đích chính là gì?
9. Trong các loại biểu đồ, biểu đồ cột (bar chart) thường được sử dụng để:
10. Trong Khoa học dữ liệu, thuật ngữ Model Evaluation (Đánh giá mô hình) đề cập đến việc:
11. Khái niệm Data Governance (Quản trị dữ liệu) trong Khoa học dữ liệu nhấn mạnh vào yếu tố nào?
12. Trong Khoa học dữ liệu, Data Transformation (Chuyển đổi dữ liệu) có thể bao gồm hoạt động nào sau đây?
13. Trong Khoa học dữ liệu, Data Storytelling (Kể chuyện dữ liệu) là quá trình:
14. Trong Khoa học dữ liệu, Overfitting (Quá khớp) xảy ra khi nào?
15. Khái niệm Bias-Variance Tradeoff (Đánh đổi giữa độ chệch và phương sai) trong Khoa học dữ liệu liên quan đến việc cân bằng giữa:
16. Loại dữ liệu nào sau đây thường được coi là có cấu trúc (structured data) và dễ dàng xử lý bằng các hệ quản trị cơ sở dữ liệu truyền thống?
17. Mục tiêu của Data Preprocessing (Tiền xử lý dữ liệu) trong Khoa học dữ liệu là gì?
18. Trong ngữ cảnh Khoa học dữ liệu, khái niệm Big Data thường được đặc trưng bởi những thuộc tính nào, theo mô hình Vs phổ biến?
19. Khi phân tích dữ liệu theo thời gian (time series analysis) trong Khoa học dữ liệu, biểu đồ nào sau đây là phù hợp nhất để quan sát xu hướng và tính mùa vụ?
20. Loại dữ liệu nào thường được phân loại là Dữ liệu phi cấu trúc (Unstructured Data)?
21. Mục tiêu chính của giai đoạn Exploratory Data Analysis (Phân tích khám phá dữ liệu) trong Khoa học dữ liệu là gì?
22. Trong Khoa học dữ liệu, Data Mining (Khai phá dữ liệu) và Machine Learning (Học máy) có mối quan hệ như thế nào?
23. Khi nói về Feature Engineering trong Khoa học dữ liệu, hoạt động nào là cốt lõi?
24. Trong Khoa học dữ liệu, một Outlier (Giá trị ngoại lai) là gì?
25. Trong Khoa học dữ liệu, nếu một mô hình có độ chính xác cao trên dữ liệu huấn luyện nhưng lại có độ chính xác thấp trên dữ liệu kiểm tra, điều này thường chỉ ra vấn đề gì?