dom-content-extraction-0.3.1 has been yanked.
dom-content-extraction
Rust implementation of Fei Sun, Dandan Song and Lejian Liao paper:
Content Extraction via Text Density (CETD)
use ;
let dtree = from_document; // &scraper::Html
let sorted_nodes = dtree.sorted_nodes;
let node_id = sorted_nodes.last.unwrap.node_id;
println!;
dtree.calculate_density_sum;
let extracted_content = dtree.extract_content;
println!
Run examples
Check examples. NOTE: add real world dataset.