Extraktor článků, který neotvírá prohlížeč — a přesto mi vyčistil testovací stránky
Většina scrapingových nástrojů, které letos poutají pozornost, chce ovládat prohlížeč. [trafilatura](https://github.com/adbar/trafilatura) ne. Je to čistě Python knihovna, která čte statické HTML, určuje, které bloky jsou skutečný článek, a zbytek zahodí...
by Ke13 min read