Алгоритм поиска подстроки в строке с помощью суффиксного массива
Пусть у нас есть образец , строка и суффиксный массив . Мы хотим найти все вхождения данного образца в данную строку. Существует несколько методов решения данной задачи.
Решение при помощи бинарного поиска
Понятно, что если образец входит в строку , то он является префиксом какого-нибудь ее суффикса. Если вхождений несколько, то в суффиксном массиве они будут находиться рядом друг с другом. Получается, что задача сводится к бинарному поиску в упорядоченном массиве.
Пусть - длина строки . Тогда на первом шаге сравниваем суффикс и образец по первому символу. Если первый элемент суффикса лексикографически больше, то необходимо идти в левую половину , иначе в правую. На следующем шаге аналогично проверяем суффикс по середине от половины суффискного массива, затем от четверти и так далее. В результате проделанной работы получим левую и правую границы и соответственно, в которых необходимо вести поиск.