Ниже я написал для расчета распределения p и null
Код: Выделить всё
x = disease['Theta']
y = nodisease['Theta']
def ranksum_statistic(x, y, axis):
stat, _ = ranksums(x, y, axis = axis, alternative='greater')
return stat
permutation_test(x, y, ranksum_statistic, permutation_type='independent',
vectorized=None, n_resamples=9999, batch=None,
alternative='greater', axis=0, random_state=None)
Я не понимаю, какой из них более подходит, если я хочу сравнить два массива разного размера (непараметрические ), которые получены из одного и того же распределения (значения разные), поскольку отсутствие болезней уже должно быть нулевым распределением.
Подробнее здесь: https://stackoverflow.com/questions/786 ... ation-test