Изменения

Перейти к: навигация, поиск

Предварительная обработка данных

20 байт добавлено, 18:51, 29 июня 2022
Нет описания правки
= Типизация признаков === Преобразование числа ==
Обычно с числами довольно удобно работать и преобразовывают их достаточно редко.
* Преобразование в категориальный признак. ('''НО''' теряется информация о порядке)
== Преобразование порядкового типа ==
[[File:Преобразование_порядкового_типа_в_k_категорий.png|250px|thumb|рис1. (A<B<C)]]
* Преобразование в число(берём его порядковый номер)
<tex>c_i(ord) := (ord < ord_i), где </tex>{<tex>ord_1, ..., ord_k</tex>} - множество значений порядкового признака.(см. рис1)
== Преобразование категории ==
[[File:Преобразование_небинарной_категории_в_бинарную.png|250px|thumb|рис2. (A<B<C)]]
* One-hot encoding - преобразование категорий в числа (0, 1): one-hot<tex>_i(c) = [c = c_i]</tex>
= Базовые методы нормализации Нормализация данных =
Применяются независимо к столбцу X
42
правки

Навигация