Đề 3 – Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

Đề 3 - Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu, 'Precision' và 'Recall' là gì?
2. Trong ngữ cảnh của khai phá dữ liệu, 'overfitting' đề cập đến điều gì?
3. Đâu là một ví dụ về ứng dụng của khai phá dữ liệu trong lĩnh vực y tế?
4. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để giảm số lượng chiều của dữ liệu trong khi vẫn giữ lại thông tin quan trọng?
5. Trong khai phá dữ liệu, mục đích của việc sử dụng 'cross-validation' là gì?
6. Trong khai phá dữ liệu, 'entropy' thường được sử dụng để đo lường điều gì?
7. Kỹ thuật nào sau đây được sử dụng để nhóm các đối tượng tương tự nhau thành các cụm?
8. Kỹ thuật nào sau đây được sử dụng để chuyển đổi dữ liệu số thành một phạm vi cụ thể, chẳng hạn như [0, 1]?
9. Trong khai phá dữ liệu, thuật ngữ 'recall' thường được liên kết với:
10. Kỹ thuật nào sau đây có thể được sử dụng để giảm số lượng thuộc tính trong tập dữ liệu bằng cách tạo ra các thuộc tính mới là tổ hợp tuyến tính của các thuộc tính ban đầu?
11. Thuật toán nào sau đây thường được sử dụng để tìm các cụm có hình dạng bất kỳ trong không gian dữ liệu?
12. Kỹ thuật nào sau đây được sử dụng để xử lý dữ liệu bị thiếu trong quá trình tiền xử lý dữ liệu?
13. Kỹ thuật nào sau đây được sử dụng để khám phá các mẫu tuần tự trong dữ liệu chuỗi thời gian?
14. Trong khai phá dữ liệu, thuật ngữ 'curse of dimensionality' đề cập đến vấn đề gì?
15. Độ đo nào sau đây thường được sử dụng để đánh giá chất lượng của các quy tắc kết hợp?
16. Trong khai phá dữ liệu, độ đo nào thường được sử dụng để đánh giá hiệu suất của một mô hình phân lớp?
17. Phương pháp nào sau đây được sử dụng để xây dựng mô hình dự đoán dựa trên một tập hợp các cây quyết định?
18. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để tìm các mối quan hệ giữa các biến trong một tập dữ liệu?
19. Mục tiêu chính của việc sử dụng kỹ thuật 'rời rạc hóa' (discretization) trong tiền xử lý dữ liệu là gì?
20. Trong khai phá dữ liệu, mục đích của việc sử dụng 'feature selection' là gì?
21. Kỹ thuật nào sau đây được sử dụng để xác định các giá trị ngoại lệ trong một tập dữ liệu?
22. Phương pháp nào sau đây thuộc về học không giám sát?
23. Trong khai phá dữ liệu, 'Gini index' thường được sử dụng trong thuật toán nào?
24. Phương pháp nào sau đây là một kỹ thuật phân cụm phân cấp?
25. Trong khai phá dữ liệu, phương pháp nào sau đây được sử dụng để dự đoán giá trị của một biến số liên tục?
26. Trong khai phá dữ liệu, thuật ngữ 'support vector' liên quan đến thuật toán nào?
27. Trong khai phá dữ liệu, 'lift' trong khai thác luật kết hợp được định nghĩa là gì?
28. Thuật toán nào sau đây thường được sử dụng để tìm các tập phổ biến trong phân tích kết hợp?
29. Đâu là một thách thức phổ biến trong khai phá dữ liệu?
30. Trong khai phá dữ liệu, mục tiêu của việc sử dụng thuật toán 'K-nearest neighbors' (KNN) là gì?