一、 NekoHTML 是什么?
- 一个 Java语言的 HTML扫描器和标签补全器(tag balancer)
- J. Andrew Clark 用Java写了一系列的 工具 (Java APIs), NekoHTML 是其中之一。
- NekoHTML 是一个简单地HTML扫描器和标签补偿器(tag balancer) ,使得程序能解析HTML文档并用标准的XML接口来访问其中的信息。这个解析器能投扫描HTML文件并“修正”许多作者(人或机器)在编写HTML文档过程中常犯的错误。 NekoHTML 能增补缺失的父元素、自动用结束标签关闭相应的元素,以及不匹配的内嵌元素标签。 NekoHTML 的开发使用了Xerces Native Interface (XNI),后者是Xerces2的实现基础。
NekoHTML 是一个 Java语言的 HTML扫描器和标签补全器(tag balancer) ,使得程序能解析HTML文档并用标准的XML接口来访问其中的信息。这个解析器能够扫描HTML文件并“修正”许多作者(人或机器)在编写HTML文档过程中常犯的错误。
NekoHTML能增补缺失的父元素、自动用结束标签关闭相应的元素,以及不匹配的内嵌元素标签。NekoHTML的开发使用了 Xerces Native Interface (XNI),后者是Xerces2的实现基础。
二、 NekoHTML 能做什么?
- 使得程序能解析HTML文档,并用标准的XML接口来访问其中的信息。
- NekoHTML