238
правок
Изменения
→ESIR: End-to-end Scene Text Recognition via Iterative Image Rectification (2018)
<br>
=== ESIR: End-to-end Scene Text Recognition via Iterative Image Rectification (2018) ===
ESIR использует итеративное выпрямление изображения, которое исправляет искажения, связанные с перспективой и кривизной. Для этого с помощью полинома моделируется средняя линия текста с помощью полиномовтекстовой области. В дополнение, определяются направление и высота области текста на множестве сегментов линии. Среднюю линию с дополнительными параметрами назовём "повторяющей линией" (см. Рисунок 8).
Представление центральной линии: <math>y = a_K ∗ x^K + a_{K−1} ∗ x^{K−1} + ... + a_1 ∗ x + a_0</math>, где <math>K</math> {{---}} степень полинома.