Libraries tagged by HTML extraction
j0k3r/php-readability
990022 Downloads
Automatic article extraction from HTML
atrox/matcher
101106 Downloads
Powerful XML and HTML matching and data extraction library
oxide/pdf-oxide
30 Downloads
The fastest PHP PDF library — 0.8ms mean, 5× faster than the industry leaders, 100% pass rate on 3,830 real-world PDFs. Text extraction, Markdown/HTML conversion, and PDF creation over a Rust core via FFI.
pforret/pf-article-extractor
2284 Downloads
PfArticleExtractor. Boilerplate Removal and Fulltext Extraction from HTML pages
moinul/laravel-pdf-to-html
172 Downloads
A Laravel package to convert PDF files to HTML using poppler-utils
dotpack/php-boiler-pipe
4988 Downloads
PhpBoilerPipe. Boilerplate Removal and Fulltext Extraction from HTML pages
vanry/readability
43 Downloads
Automatic article content extraction from html and html parser.
sleimanx2/grawler
297 Downloads
A guided html crawler with media meta extraction
ncjoes/pdf-suite
276 Downloads
A high level wrapper over Poppler-Php for PDF content extraction and conversion using Poppler utils
make-dev/orca-harpoon
39 Downloads
Extract HTML elements into Livewire components with a single click. OrcaHarpoon lets you visually inspect any element on your page and instantly scaffold a new Livewire component from it.
aspose/pdf
868 Downloads
A powerful library for manipulating and converting PDF files.
anshu-krishna/html-scraper
19 Downloads
A set of PHP classes to simplify data extraction from HTML.
matejch/html_helpers
7 Downloads
Helper class for removing elements and content, and extracting file paths
sharpapi/laravel-web-scraping-api
4 Downloads
Web Scraping API for Laravel powered by SharpAPI.com
gregpriday/laravel-zyte-api
30 Downloads
A Laravel package for seamless integration with Zyte's web scraping API, offering functionalities for extracting raw HTML, browser-rendered HTML, and structured article content.