首页 诗词 字典 板报 句子 名言 友答 励志 学校 网站地图
当前位置: 首页 > 教程频道 > 网站开发 > CSS >

资讯正文提取之joyhtml

2013-10-28 
新闻正文提取之joyhtmlpublic static void main(String[] args) throws Exception {DOMParser parser ne

新闻正文提取之joyhtml
public static void main(String[] args) throws Exception {DOMParser parser = new DOMParser();String url = "http://finance.people.com.cn/n/2013/1011/c66323-23157265.html";parser.parse(new InputSource(new URL(url).openStream()));Document doc = parser.getDocument();TextExtractor extractor = new TextExtractor(doc);String str = extractor.extract();System.out.println(str);}

?

依赖的lib参见附件


没有报这个错吧?
import org.cyberneko.html.parsers.DOMParser;
import org.joy.analyzer.html.TextExtractor;
import org.w3c.dom.Document;
import org.xml.sax.InputSource;

热点排行