Đề 8 – Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

Đề 8 - Đề thi, câu hỏi trắc nghiệm online Khai phá dữ liệu

1. Trong khai phá dữ liệu, phương pháp nào được sử dụng để chuyển đổi dữ liệu định tính thành dữ liệu định lượng?
2. Thuật toán nào sau đây thường được sử dụng để phân tích tình cảm (sentiment analysis) trong văn bản?
3. Đâu là một phương pháp đánh giá hiệu quả mô hình phân loại?
4. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để giảm số lượng chiều dữ liệu trong khi vẫn giữ lại thông tin quan trọng nhất?
5. Trong khai phá dữ liệu, thuật ngữ 'outlier' đề cập đến điều gì?
6. Trong khai phá dữ liệu, 'support', 'confidence', và 'lift' là các thước đo liên quan đến kỹ thuật nào?
7. Thuật toán nào sau đây thường được sử dụng để phân cụm dữ liệu dựa trên khoảng cách giữa các điểm dữ liệu?
8. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để khám phá các mối quan hệ giữa các mục trong một tập dữ liệu?
9. Trong khai phá dữ liệu, 'overfitting' xảy ra khi nào?
10. Trong khai phá dữ liệu, thuật ngữ 'feature engineering' đề cập đến quá trình gì?
11. Phương pháp nào sau đây giúp xác định các thuộc tính quan trọng nhất ảnh hưởng đến kết quả dự đoán trong một mô hình?
12. Trong khai phá dữ liệu, phương pháp nào được sử dụng để đánh giá sự khác biệt giữa hai phân phối xác suất?
13. Trong khai phá dữ liệu, mục đích của việc sử dụng 'ensemble methods' là gì?
14. Kỹ thuật nào được sử dụng để chuyển đổi dữ liệu số thành các khoảng rời rạc?
15. Thuật toán nào sau đây thường được sử dụng để giảm chiều dữ liệu phi tuyến tính?
16. Phương pháp nào sau đây được sử dụng để tìm kiếm các mẫu tuần tự trong dữ liệu?
17. Đâu là một ví dụ về ứng dụng của khai phá dữ liệu trong lĩnh vực y tế?
18. Trong khai phá dữ liệu, phương pháp nào được sử dụng để xử lý dữ liệu không cân bằng (imbalanced data) trong bài toán phân loại?
19. Trong khai phá dữ liệu, mục đích của việc sử dụng 'cross-validation' là gì?
20. Trong khai phá dữ liệu, kỹ thuật nào được sử dụng để tìm kiếm các nhóm người dùng có hành vi tương tự nhau trên một trang web?
21. Phương pháp nào sau đây thường được sử dụng để giảm overfitting trong cây quyết định?
22. Phương pháp nào sau đây được sử dụng để xử lý dữ liệu thiếu trong quá trình tiền xử lý dữ liệu?
23. Cho một bài toán phân loại email là spam hay không spam, bạn sử dụng mô hình nào sau đây là phù hợp nhất?
24. Cho một tập dữ liệu chứa thông tin về khách hàng, bạn muốn phân nhóm khách hàng dựa trên hành vi mua sắm của họ. Phương pháp khai phá dữ liệu nào phù hợp nhất?
25. Cho một bài toán dự đoán khả năng một khách hàng sẽ rời bỏ dịch vụ (churn prediction), đâu là thước đo đánh giá quan trọng nhất?
26. Thuật toán nào sau đây là một ví dụ của phương pháp học có giám sát (supervised learning)?
27. Trong khai phá dữ liệu, 'precision' và 'recall' là gì?
28. Phương pháp nào sau đây thường được sử dụng để đánh giá mức độ phù hợp của một mô hình thống kê với dữ liệu?
29. Trong khai phá dữ liệu, thuật ngữ 'curse of dimensionality' đề cập đến vấn đề gì?
30. Trong khai phá dữ liệu, mục đích của việc chuẩn hóa dữ liệu là gì?