Предварительная обработка данных — различия между версиями
(→Декорреляция) |
|||
Строка 18: | Строка 18: | ||
= Декорреляция = | = Декорреляция = | ||
− | + | [[File:Декорреляция.png|300px|thumb|рис1]] | |
1. Есть матрица X. | 1. Есть матрица X. | ||
Версия 17:42, 29 июня 2022
Базовые методы нормализации данных
Применяются независимо к столбцу X
Важно в sklearn.preprocessing есть метод normalize, но это не то, что нам нужно, он рассматривает нормализацию с геометрической точки зрения (представляет объект в виде вектора), а не по столбцам
Минмакс, [0;1] масштабирование
После нормализации:
и
Стандартизация, Z-масштабирование
После нормализации:
иДекорреляция
1. Есть матрица X.
2. Матрицу центрировали (
).3. Ковариация вычисляется по следующей формуле:
4. Если же матрица нормализована так, что
, то из произведения мы получим не ковариационную, а корреляционную матрицу5. Декорреляция вычисляется по формуле:
где
находится из разложения ХолецкогоУтверждение: |
После декорреляции: |
. |