Изменения

← Предыдущая правка

Поиск k-ой порядковой статистики за линейное время

5037 байт добавлено, 19:05, 4 сентября 2022

м

rollbackEdits.php mass rollback

~~{{Определение~~Алгоритм был разработан Мануэлем Блюмом (Manuel Blum), Робертом Флойдом (Robert Floyd), Воганом Рональдом Праттом (Vaughan Ronald Pratt), Роном Ривестом (Ron Rivest), Робертом Тарьяном (Robert Tarjan).~~|definition~~==Идея алгоритма==~~'''~~Этот алгоритм является модификацией алгоритма [[Поиск k-ой порядковой статистики|поиска k-ой порядковой статистики]]. Важное отличие заключается в том, что время работы алгоритма в наихудшем случае — <tex>O(n)</tex>, где <tex>kn</tex>~~-ой порядковой статистикой~~— количество элементов в множестве. Главная идея алгоритма заключается в том, чтобы ''гарантировать'' ~~набора элементов линейно упорядоченного множества называется~~ хорошее разбиение массива. Алгоритм выбирает такой ~~его~~ рассекающий элемент, ~~который является~~ что количество чисел, которые меньше рассекающего элемента, не менее <tex>k\dfrac{3n}{10}</tex>~~-ым элементом набора в порядке сортировки~~. Элементов же больших опорного элемента, также не менее <tex>\dfrac{3n}{10}~~== Историческая справка ==~~</tex>. Благодаря этому алгоритм работает за линейное время в любом случае.

~~'''Алгоритм Блюма-Флойда-Пратта-Ривеста-Тарьяна'''~~ == Описание алгоритма ==#Все <tex>n</tex> элементов входного массива разбиваются на группы по пять элементов, в последней группе будет <tex>n \bmod 5</tex> элементов. Эта группа может оказаться пустой при <tex>n</tex> кратным <tex>5</tex>.#Сначала сортируется каждая группа, затем из каждой группы выбирается медиана.#Путем рекурсивного вызова шага определяется медиана <tex>x</tex> из множества медиан (~~BFPRT-алгоритм~~верхняя медиана в случае чётного количества) ~~создан Мануэлем Блюмом~~, найденных на втором шаге. Найденный элемент массива <tex>x</tex> используется как рассекающий (~~Manuel Blum~~за <tex>i</tex> обозначим его индекс).#Массив делится относительно рассекающего элемента <tex>x</tex>.#Если <tex>i = k</tex>, ~~Робертом Флойдом~~то возвращается значение <tex>x</tex>. Иначе запускается рекурсивно поиск элемента в одной из частей массива: <tex>k</tex>-ой статистики в левой части при <tex>i > k</tex> или <tex>(~~Robert Floyd~~k - i - 1)</tex>-ой статистики в правой части при <tex>i < k</tex> === Пример работы алгоритма ===Рассмотрим работу алгоритма на массиве из <tex> 25 </tex> элементов, ~~Воганом Рональдом Праттом(Vaughan Ronald Pratt)~~обозначенных кружками. На вход подается массив, ~~Роном Ривестом(Ron Rivest)~~ разобьем элементы на группы по 5 элементов.Отсортируем элементы каждой группы и ~~Рональдом Тарьяном(Robert Tarjan) в 1973 году~~выберем медианы. Полученные медианы групп отмечены белыми кружками.

~~== Описание алгоритма ==~~[[Файл:поиск.png| 300px]] ~~Разбиваем наш массив на группы по 5 элементов(на самом деле можно разбивать~~ Рекурсивно вызовемся от медиан групп и ~~на другое нечетное количество элементов больших 5)~~получим рассекающий элемент. На рисунке он обозначен белым кружком, внутри которого изображен символ <tex> x </tex>. [[Файл:поиск2. ~~Затем~~ png| 300px]] На рисунке обозначены закрашенные области, в левом верхнем и в правом нижнем углах. В эти области попали все элементы, которые точно меньше или больше рассекающего элемента, соответственно. В каждой ~~группе находим средний элемент~~области по <tex> 8 </tex> элементов, всего же в массиве <tex> 25 </tex>, то есть мы получили хорошее (~~медиану~~то есть соответствующее нашему утверждению)разбиение массива относительно опорного элемента, ~~это можно сделать любой сортировкой~~так как <tex> 8 > </tex> <tex>\dfrac{3 \cdot 25}{10}</tex>. ~~И запускаем рекурсивно этот~~ Теперь докажем, что алгоритм ~~от медиан. Тем самым мы найдем средний~~ также хорошо выбирает опорный элемент ~~среди медиан, то есть медиану медиан~~и в общем случае. ~~Эту медиану медиан выберем рассекающим элементом~~ Cначала определим нижнюю границу для ~~поиска~~ количества элементов, превышающих по величине рассекающий элемент <tex>kx</tex>~~-го элемента~~. ~~Далее разбиваем массив~~ В общем случае как минимум половина медиан, найденных на ~~две части: слева от рассекающего элемента числа меньшие него~~втором шаге, ~~а справа - числа~~ больше ~~рассекающего элемента~~ или ~~равные ему~~равны медианы медиан <tex>x</tex>. ~~И рекурсивно запускаем наш алгоритм от той части массива~~Таким образом, как минимум <tex>\dfrac{n}{10}</tex> групп содержат по <tex>3</tex> превышающих величину <tex>x</tex>, за исключение группы, в ~~котором будет лежать~~ которой меньше <tex>k5</tex>-й элементов и ещё одной группы, содержащей сам элемент<tex>x</tex>. Таким образом получаем, что количество элементов больших <tex>x</tex>, не менее <tex>\dfrac{3n}{10}</tex>. Проведя аналогичные рассуждения для элементов, которые меньше по величине, чем рассекающий элемент <tex>x</tex>, мы получим, что как минимум <tex>\dfrac{3n}{10}</tex> меньше, чем элемент <tex>x</tex>. Теперь проведем анализ времени работы алгоритма. [[Файл:поиск5.png| 300px]]

== Анализ времени работы алгоритма ==

Пусть <tex>T(n)</tex> - — время работы алгоритма для <tex>n</tex> элементов, тогда оно ~~меньше~~не больше, чем ~~<tex>Cn</tex> - время~~ сумма:# времени работы на сортировку групп и разбиение по рассекающему элементу, ~~время сумма время~~ то есть <tex>Cn</tex>;# времени работы для поиска медианы медиан, то есть <tex>T</tex><tex>\left(\~~frac~~dfrac{n}{5}\right)</tex> ~~и время~~ ;# времени работы для поиска <tex>k</tex>-го элемента в одной из двух частей массива, то есть <tex>T(ks)</tex>, где <tex>ks</tex>- — количество элементов в этой части~~, но~~ . Но <tex>ks</tex> не превосходит <tex>\~~frac~~dfrac{7n}{10}</tex>, так как чисел ~~меньше~~ , меньших рассекающего элемента , не менее <tex>\~~frac~~dfrac{3n}{10}</tex> - — это <tex>\~~frac~~dfrac{n}{10}</tex> медиан ~~меньшие~~ , меньших медианы медиан , плюс не менее <tex>\~~frac~~dfrac{2n}{10}</tex> элементов ~~меньшие~~ , меньших этих медиан~~, с~~ . С другой стороны , чисел , больших рассекающего элемента , так же не менее <tex>\~~frac~~dfrac{3n}{10}</tex>, следовательно <tex> k s \le leqslant </tex> <tex>\~~frac~~dfrac{7n}{10}</tex>, то есть в худшем случае <tex> k s = </tex> <tex>\~~frac~~dfrac{7n}{10}</tex>.

Тогда получаем, что

<tex>T(n) \le leqslant T</tex><tex>\left(\~~frac~~dfrac{n}{5}\right) </tex><tex> + T</tex><tex>\left(\~~frac~~dfrac{7n}{10}\right) </tex><tex> + Cn </tex>

Покажем, что для всех <tex> n </tex> выполняется неравенство <tex>T(n) \le leqslant 10Cn </tex>.

Докажем по индукции:

# ~~Очевидно~~Предположим, что ~~для малых~~ наше неравенство <tex> T(n ) \leqslant 10Cn </tex> выполняется ~~неравенство~~ при малых <tex>T(n~~) \le 10Cn~~ </tex> , для некоторой достаточно большой константы <tex> C </tex>. # Тогда , по предположению индукции, <tex>T</tex><tex>\left(\~~frac~~dfrac{n}{5}\right) </tex> <tex> \le leqslant 10C(</tex><tex>\~~frac~~dfrac{n}{5}) </tex> <tex> = 2Cn</tex> и <tex> T</tex><tex>\left(\~~frac~~dfrac{~~10n~~7n}{710}\right) </tex> <tex> \le leqslant 10C(</tex><tex>\~~frac~~dfrac{7n}{10}) </tex> <tex> = 7Cn</tex>, тогда<tex>T(n) \le leqslant T</tex><tex>\left(\~~frac~~dfrac{n}{5}\right) </tex> <tex> + T</tex><tex>\left(\~~frac~~dfrac{7n}{10}\right) </tex> <tex> + Cn = 2Cn + 7Cn + Cn = 10Cn \Rightarrow T(n) \le leqslant 10Cn</tex> Так как <tex>T(n) \leqslant 10Cn </tex>, то время работы алгоритма <tex>O(n)</tex>

~~Так как <tex>T(n) \le 10Cn <~~==Источники инфомации==* Кормен, Т., Лейзерсон, Ч., Ривест, Р., Штайн, К. '''Алгоритмы: построение и анализ''' {{---}} Вильямс, 2013. {{---}} 1328 с. {{---}} ISBN 978-5-8459-1794-2* [http:/~~tex>, то время работы алгоритма <tex>O(n)<~~/~~tex>~~en.wikipedia.org/wiki/BFPRT#Linear_general_selection_algorithm_-_Median_of_Medians_algorithm Wikipedia — Selection algorithm]

~~== Ссылки ==~~[[Категория: Дискретная математика и алгоритмы]][[Категория: Сортировки]]* [~~http~~[Категория:~~//en.wikipedia.org/wiki/BFPRT#Linear_general_selection_algorithm_-_Median_of_Medians_algorithm Selection algorithm — Wikipedia~~Другие сортировки]]

Maintenance script

1632

правки

Изменения

Поиск k-ой порядковой статистики за линейное время

Навигация

Персональные инструменты

Пространства имён

Варианты

Просмотры

Ещё

Поиск

Навигация

Инструменты