Trong hầu hết các kiểm định phi tham số (kiểm định dấu, Wilcoxon, Mann–Whitney, Spearman, Kruskal–Wallis, ...), bước xử lý số liệu đầu tiên là xếp hạng (rank) các quan sát: giá trị nhỏ nhất được gán hạng 1, giá trị nhỏ thứ hai được gán hạng 2, ..., giá trị lớn nhất được gán hạng n.
Khi có k giá trị bằng nhau (gọi là một nhóm trùng), quy ước chuẩn của thống kê phi tham số là gán cho tất cả k giá trị đó cùng một hạng trung bình (midrank), bằng trung bình cộng của k hạng liên tiếp mà lẽ ra chúng nhận được nếu không trùng nhau.
Ví dụ: với dãy 10,20,20,30,40, sắp tăng dần ta có vị trí 1,2,3,4,5. Giá trị 20 xuất hiện ở vị trí 2 và 3 nên nhận hạng trung bình 22+3=2.5. Vậy hạng tương ứng theo đúng thứ tự xuất hiện trong dữ liệu gốc là: 1.0, 2.5, 2.5, 4.0, 5.0.
Một tính chất quan trọng cần kiểm tra: dù có trùng hay không, tổng tất cả các hạng luôn bằng 2n(n+1).
Cho n số liệu quan sát, hãy tính hạng (midrank) của từng số liệu theo đúng thứ tự xuất hiện trong input, và tính tổng các hạng để kiểm tra.
Ví dụ với input:
5
10 20 20 30 40
Output:
1.0 2.5 2.5 4.0 5.0
15.0
Ví dụ:
Đầu vào:
5
10 20 20 30 40
Đầu ra:
1.0 2.5 2.5 4.0 5.0
15.0
Đầu vào:
1
5
Đầu ra:
1.0
1.0
Đang tải editor...