Đề 4 – Bài tập, đề thi trắc nghiệm online Thống kê ứng dụng

Đề 4 - Bài tập, đề thi trắc nghiệm online Thống kê ứng dụng

1. Khoảng tin cậy (confidence interval) cho trung bình tổng thể được sử dụng để:
2. Kỹ thuật `bootstrap′ trong thống kê ứng dụng được sử dụng chủ yếu cho mục đích gì?
3. Trong phân tích hồi quy tuyến tính đơn giản, hệ số góc (slope) cho biết điều gì?
4. Khi thực hiện kiểm định Chi-bình phương về tính độc lập, giả thuyết null (H0) thường là gì?
5. Ứng dụng nào sau đây KHÔNG phải là một ví dụ của thống kê mô tả?
6. Ưu điểm chính của việc sử dụng phương pháp thống kê Bayes so với phương pháp thống kê tần suất (frequentist) là gì?
7. Phương pháp nào sau đây KHÔNG phải là một kỹ thuật lấy mẫu xác suất?
8. Trong thống kê ứng dụng, khái niệm `đa cộng tuyến′ (multicollinearity) đề cập đến vấn đề gì trong mô hình hồi quy bội?
9. Hệ số tương quan Pearson đo lường điều gì giữa hai biến định lượng?
10. Trong phân tích phương sai (ANOVA), mục đích chính là gì?
11. Trong phân tích hồi quy logistic, biến phụ thuộc thuộc loại dữ liệu nào?
12. Khi nào nên sử dụng kiểm định phi tham số thay vì kiểm định tham số?
13. Trong thống kê ứng dụng, loại dữ liệu nào thường được sử dụng để biểu diễn các danh mục hoặc nhóm, không có thứ tự tự nhiên?
14. Phương pháp thống kê nào thường được sử dụng để dự báo giá trị tương lai dựa trên dữ liệu quá khứ theo thời gian?
15. Giá trị P (p-value) trong kiểm định giả thuyết thể hiện điều gì?
16. Mục đích của việc chuẩn hóa dữ liệu (data normalization) trong thống kê là gì?
17. Biến `nhiễu′ (confounding variable) trong nghiên cứu quan sát là gì?
18. Trong phân tích sống sót (survival analysis), hàm sống sót (survival function) S(t) biểu thị điều gì?
19. Khi so sánh hai nhóm độc lập về trung bình, kiểm định t-test hai mẫu độc lập giả định điều gì về phương sai của hai nhóm?
20. Phương pháp nào sau đây thường được sử dụng để giảm số chiều dữ liệu trong phân tích thống kê, đặc biệt khi làm việc với dữ liệu nhiều chiều?
21. Phương pháp lấy mẫu nào đảm bảo mỗi cá thể trong tổng thể đều có cơ hội được chọn vào mẫu như nhau?
22. Trong kiểm định giả thuyết thống kê, lỗi loại II (Type II error) xảy ra khi:
23. Sai số chuẩn của trung bình (standard error of the mean) đo lường điều gì?
24. Phép đo lường độ phân tán nào sau đây ít bị ảnh hưởng nhất bởi các giá trị ngoại lệ trong một tập dữ liệu?
25. Khi nào thì việc sử dụng trung vị (median) thích hợp hơn so với trung bình cộng (mean) để đo xu hướng trung tâm của dữ liệu?
26. Loại biểu đồ nào thích hợp nhất để thể hiện sự phân bố tần số của một biến định lượng liên tục?
27. Trong ngữ cảnh của `Big Data′, thống kê ứng dụng đóng vai trò quan trọng nhất trong giai đoạn nào của quy trình phân tích?
28. Khi kích thước mẫu tăng lên, điều gì thường xảy ra với chiều rộng của khoảng tin cậy (confidence interval)?
29. Trong phân tích dữ liệu định tính, phương pháp nào tập trung vào việc tìm kiếm các chủ đề và mô hình lặp đi lặp lại trong dữ liệu văn bản?
30. Trong thống kê ứng dụng, `dữ liệu bảng′ (panel data) đề cập đến loại dữ liệu nào?