Đề 9 – Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

Đề 9 - Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu, thuật ngữ 'outlier' (ngoại lệ) đề cập đến điều gì?
2. Phương pháp nào sau đây được sử dụng để đánh giá hiệu quả của một mô hình phân cụm?
3. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu thiếu trong quá trình tiền xử lý dữ liệu?
4. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để phân nhóm các đối tượng tương tự thành các cụm dựa trên các đặc điểm của chúng?
5. Thuật toán nào sau đây KHÔNG thuộc nhóm thuật toán phân cụm?
6. Thuật ngữ nào mô tả việc lựa chọn các biến quan trọng nhất từ một tập dữ liệu để sử dụng trong mô hình khai phá dữ liệu?
7. Trong khai phá dữ liệu, thuật ngữ nào mô tả quá trình chuyển đổi dữ liệu thô thành một định dạng phù hợp cho phân tích?
8. Trong khai phá dữ liệu, 'độ tin cậy' (confidence) của một luật kết hợp được định nghĩa là gì?
9. Trong khai phá dữ liệu, 'rời rạc hóa dữ liệu' (data discretization) là gì?
10. Trong khai phá dữ liệu, mục tiêu của việc 'chuẩn hóa dữ liệu' là gì?
11. Kỹ thuật nào sau đây được sử dụng để khám phá các mẫu tuần tự trong dữ liệu?
12. Trong khai phá dữ liệu, thuật ngữ 'bias-variance tradeoff' (đánh đổi giữa độ chệch và phương sai) đề cập đến điều gì?
13. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để giảm số lượng chiều của dữ liệu trong khi vẫn giữ lại thông tin quan trọng?
14. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để dự đoán một biến phân loại (categorical variable)?
15. Phương pháp nào sau đây được sử dụng để giảm số lượng chiều dữ liệu trong khi vẫn giữ lại các đặc trưng quan trọng nhất?
16. Trong khai phá dữ liệu, 'độ hỗ trợ' (support) của một luật kết hợp được định nghĩa là gì?
17. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để tìm các nhóm khách hàng có hành vi mua hàng tương tự?
18. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để tìm các mối quan hệ hoặc mẫu phổ biến giữa các tập hợp mục trong cơ sở dữ liệu giao dịch?
19. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu văn bản trong khai phá dữ liệu?
20. Phương pháp nào sau đây KHÔNG phải là một phương pháp tiền xử lý dữ liệu?
21. Độ đo nào sau đây được sử dụng để đánh giá sự tương đồng giữa hai cụm trong thuật toán phân cụm?
22. Độ đo nào sau đây được sử dụng để đánh giá hiệu quả của một mô hình phân loại?
23. Độ đo nào sau đây được sử dụng để đánh giá khả năng của một mô hình phân loại trong việc dự đoán chính xác các trường hợp dương tính?
24. Độ đo nào sau đây được sử dụng để đánh giá mức độ liên quan giữa các biến trong một tập dữ liệu?
25. Phương pháp nào sau đây được sử dụng để xử lý dữ liệu không cân bằng (imbalanced data) trong phân loại?
26. Đâu là một thách thức chính trong việc khai phá dữ liệu từ các nguồn dữ liệu lớn (Big Data)?
27. Phương pháp nào trong khai phá dữ liệu được sử dụng để dự đoán giá trị của một biến số dựa trên giá trị của các biến số khác?
28. Trong khai phá dữ liệu, thuật ngữ 'ensemble learning' (học tập kết hợp) đề cập đến điều gì?
29. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để tìm các mối quan hệ nhân quả giữa các biến?
30. Trong bối cảnh khai phá dữ liệu, 'overfitting' (quá khớp) đề cập đến điều gì?