ru-html-extractor 0.1.0

A universal web page main content extractor based on line block density distribution.
Documentation
1
2
3
4
5
6
7
8
9
10
11
12
13
[package]
name = "ru-html-extractor"
version = "0.1.0"
edition = "2021"
license = "MIT"
description = "A universal web page main content extractor based on line block density distribution."
repository = "https://github.com/ipconfiger/html-text-extractor/tree/main"

[dev-dependencies]
reqwest = { version = "0.12.7",  default-features = false, features = ["rustls-tls", "blocking", "json"]}

[dependencies]
regex = "1.10.6"