Đề 10 – Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

Đề 10 - Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu, 'precision' và 'recall' là các độ đo hiệu suất được sử dụng trong bài toán nào?
2. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để giảm số lượng biến đầu vào trong mô hình dự đoán?
3. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để khám phá các mối quan hệ giữa các mục trong một tập dữ liệu giao dịch?
4. Trong khai phá dữ liệu, ROC curve (Receiver Operating Characteristic curve) được sử dụng để đánh giá hiệu suất của mô hình nào?
5. Trong khai phá dữ liệu, 'entropy' và 'information gain' được sử dụng trong thuật toán nào?
6. Trong khai phá dữ liệu, mục đích chính của việc làm sạch dữ liệu là gì?
7. Đâu là một ứng dụng của khai phá dữ liệu trong lĩnh vực tài chính?
8. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu văn bản trong khai phá dữ liệu?
9. Trong ngữ cảnh khai phá dữ liệu, 'curse of dimensionality' đề cập đến vấn đề gì?
10. Phương pháp nào sau đây thường được sử dụng để xử lý dữ liệu bị thiếu trong khai phá dữ liệu?
11. Trong khai phá dữ liệu, thuật ngữ 'feature engineering' đề cập đến quá trình nào?
12. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để khám phá cấu trúc ẩn trong dữ liệu bằng cách giảm số lượng chiều dữ liệu?
13. Phương pháp khai phá dữ liệu nào được sử dụng để tìm các nhóm đối tượng tương tự nhau dựa trên các thuộc tính của chúng?
14. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để tìm các chuỗi sự kiện xảy ra theo một trình tự nhất định?
15. Trong khai phá dữ liệu, 'root mean squared error' (RMSE) là một độ đo được sử dụng để đánh giá hiệu suất của mô hình nào?
16. Trong ngữ cảnh khai phá dữ liệu, 'overfitting' đề cập đến vấn đề gì?
17. Trong khai phá dữ liệu, 'support', 'confidence', và 'lift' là các độ đo quan trọng trong kỹ thuật nào?
18. Trong khai phá dữ liệu, kỹ thuật nào thường được sử dụng để giảm số lượng chiều dữ liệu trong khi vẫn giữ lại thông tin quan trọng?
19. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để dự đoán giá trị của một biến số dựa trên giá trị của các biến số khác?
20. Đâu là một ứng dụng phổ biến của khai phá dữ liệu trong lĩnh vực marketing?
21. Đâu là một thách thức lớn trong việc khai phá dữ liệu từ các nguồn dữ liệu lớn và phức tạp?
22. Thuật toán nào sau đây thường được sử dụng để phân cụm dữ liệu?
23. Trong khai phá dữ liệu, 'cross-validation' là kỹ thuật được sử dụng để làm gì?
24. Trong khai phá dữ liệu, thuật ngữ 'ensemble methods' đề cập đến điều gì?
25. Trong khai phá dữ liệu, 'support vector machine' (SVM) là một thuật toán thuộc loại nào?
26. Trong khai phá dữ liệu, 'data warehouse' là gì?
27. Trong khai phá dữ liệu, kỹ thuật 'association rule mining' thường được sử dụng để giải quyết bài toán nào?
28. Phương pháp nào sau đây thường được sử dụng để đánh giá mức độ tương đồng giữa hai chuỗi văn bản trong khai phá văn bản?
29. Kỹ thuật nào trong khai phá dữ liệu được sử dụng để xác định các điểm dữ liệu khác biệt đáng kể so với phần còn lại của tập dữ liệu?
30. Mục tiêu của việc sử dụng kỹ thuật 'rời rạc hóa dữ liệu' (data discretization) trong tiền xử lý dữ liệu là gì?