Изменения

Перейти к: навигация, поиск

Выброс

220 байт убрано, 10:54, 25 января 2020
Источники информации
[[Файл:Outlier_boxplot.png|upright=1.0|thumb|Рис 1.График boxplot населения регионов России в 1990 году, где можно заметить 5 выбросов]]
'''Выброс''' (англ. ''outlier'') {{---}} это экстремальные значения во входных данных, которые находятся далеко за пределами других наблюдений. Простой бытовой пример: Например, все предметы на кухне имеют температуру около 22-25 грудусовЦельсия, а {{---}} духовка 220.
Многие алгоритмы машинного обучения чувствительны к разбросу и распределению значений признаков обрабатываемых объектов. Соответственно, выбросы во входных данных могут исказить и ввести в заблуждение процесс обучения алгоритмов машинного обучения, что приводит к увеличению времени обучения, снижению точности моделей и, в конечном итоге, к снижению результатов. Даже до подготовки предсказательных моделей на основе обучающих данных выбросы могут приводить к ошибочным представлениям и в дальнейшем к ошибочной интерпретации собранных данных.
===Виды выбросов===
Выбросы могут быть двух видов: На основе размерности изучаемого массива данных выбросы подразделяют на одномерные и многомерные. ;Одномерные выбросы можно найти при рассмотрении распределения значений объектов в одномерном пространстве:Точка является выбросом только по одной из своих координат. ;Многомерные выбросы можно найти в <tex>n</tex>-мерном пространстве (из <tex>n</tex> объектов). Рассмотрение распределений в <tex>n</tex>-мерных пространствах может быть очень сложным для человеческого мозга, поэтому необходимо обучить модель, чтобы сделать это:Точка является выбросом сразу по нескольким координатам.
Другой подход классификации выбросов {{---}} по их окружению.
# https://machinelearningmastery.com/how-to-identify-outliers-in-your-data/
# https://ru.coursera.org/lecture/vvedenie-mashinnoe-obuchenie/obnaruzhieniie-vybrosov-t9PG4
# https://www.reg.ru/blog/ishchem-anomalii-s-python-chast-1/
 
[[Категория: Машинное обучение]]
[[Категория: Статистика]]
Анонимный участник

Навигация