13 listopada, po ponad roku prac, wydano 2.4.0 wydajnej biblioteki do parsowania HTML5 i CSS lexbor, napisanej w języku C bez zewnętrznych zależności i dystrybuowanej na licencji Apache 2.0.
Biblioteka jest podzielona na moduły (Core, CSS, DOM, Encoding, HTML, NS, Punycode, Selectors, Tag, Unicode, URL, Utils), które mogą być kompilowane i używane oddzielnie (z opcją CMake LEXBOR_BUILD_SEPARATELY=ON).
Biblioteka ma zewnętrzne wiązania i wrappery dla języków Elixir, Crystal, Python, D, Ruby i PHP.
Lista zmian:
- Core: zwiększona wydajność dzięki SWAR (spakowane SIMD);
- URL: dodano API do zmiany obiektu URL;
- URL: dodano możliwość klonowania url;
- URL: usunięcie nowych linii i tabulacji przed parsowaniem;
- Encoding: zaktualizowano indeks GB18030-2022;
- Encoding: zmniejszono rozmiar danych statycznych;
- URL: zwiększenie wydajności;
- poprawki błędów i ulepszenia testów.
Źródło: linux.org.ru
