Przedstawiono narzędzie Unredacter, które umożliwia odzyskiwanie pierwotnego tekstu po jego ukryciu za pomocą filtrów opartych na pikselizacji. Program może być używany do identyfikowania danych wrażliwych oraz haseł, które zostały pikselizowane na zrzutach ekranu lub zdjęciach dokumentów. Uważa się, że algorytm wdrożony w Unredacter przewyższa wcześniej dostępne podobne narzędzia, takie jak Depix, i został skutecznie wykorzystany do przeprowadzenia testu na wykrywanie pikselizowanego tekstu, zaproponowanego przez laboratorium Jumpsec. Kod programu został napisany w TypeScript i jest udostępniany na licencji GPLv3.
W Unredacterze do odzyskiwania tekstu stosowana jest metoda odwrotnego dopasowywania, w ramach której porównywana jest część źródłowego pikselizowanego obrazu z wariantem, syntetyzowanym poprzez kombinacje par znaków pikselizowanych z różnymi przesunięciami i zmodyfikowanymi parametrami. W trakcie dopasowywania stopniowo wybierany jest wariant, który najbardziej odpowiada źródłowemu fragmentowi. Aby operacja zakończyła się sukcesem, należy prawidłowo odgadnąć rozmiar, typ i parametry odstępów czcionki, a także obliczyć rozmiar komórki w siatce pikselizacji i położenie nałożenia tej siatki na tekst (warianty przesunięcia siatki są automatycznie testowane).

Dodatkowo można wspomnieć o projekcie DepixHMM, w ramach którego przygotowano wersję narzędzia Depix, przetłumaczoną na algorytm bazujący na ukrytej marce modelowej, dzięki któremu udało się poprawić dokładność rekonstrukcji znaków.
Źródło: opennet.ru
