iOS html标签解析解决方案

最新推荐文章于 2021-07-22 02:23:18 发布

原创最新推荐文章于 2021-07-22 02:23:18 发布 · 6.9k 阅读

0 ·

CC 4.0 BY-SA版权

文章标签：

#解决方案 #标签 #html #ios #应用

iOS 开发问题解决纪录专栏收录该内容

5 篇文章

订阅专栏

本文介绍了在iOS中解析HTML标签的问题，提出了两种思路：后台匹配发送数据和适配传输内容，选择了后者并采用TFHpple库进行解析。然而，TFHpple库存在数据丢失的问题，于是进行了优化，将数据结构改为NSArray，并处理了顺序和限制条件，实现了文本、图片、文件标签的完整解析。

由于项目是基于 b/s结构，因为在pc端上是没有客户端这概念只有浏览器，而对于web与移动端的关系，实际上还是类似于 C/S结构，因此web端与web端的通信是通过发送HTML5标签来实现，常规的做法中pc端与移动端是通过数据文本、文件来通信来交流信息的而非HTML5标签。

解决方案：

为了解决通信的矛盾，一般有两个思路：（1）后台根据发送目标来匹配发送数据。（2）适配传输内容。

思路一基于现有的条件来说实现难度大，而且不大现实。而思路二，也有一定的实现难度，但较思路一要现实，因此选择思路二。

思路二的具体实现方案有两种，方案一是基于文本发送，前端收到文本信息后再封装成html5标签进行显示，而移动端直接接受显示。方案二是html5标签，web端直接显示，移动端解析显示。

项目需要，选择方案二。

Hpple

hpple，它是一个轻量级的包装框架，可以很好的解决这个问题，尤其是它支持HTML的解析，是其他XML类库所不及的地方，它是用XPath来定位和解析HTML或者XML。githut下载地址

XPath定位原理

Xpath将xml的文档结构视为一个树形结构，元素、属性、文本、注释以及处理指令都是这个树形结构上的节点，对于xml文档中元素、属性、文本、注释以及处理指令的访问实际上是按顺序遍历这棵树，使用Xpath的路径表示法，可以定位到XML文档中的一个节点或者节点集合。

在Xpath中，可以使用相关标识来定位元素以及其属性，这些标识符关键字主要有：child、self、parent、descendant、attribute等。

child为默认标识符，self表示当前节点，parent表示上一级节点。

descendant表示当前子孙节点，attribute表示当前节点的属性。

绝对路径的Xpath表示

绝对路径是从根节点到目标节点所经历的路径。

Xpath详细学习地址： http://www.w3school.com.cn/xpath/xpath_functions.asp

im模块通信常见HTML5标签样式

//-------------------- 纯文本 ----------------------------------//
 //NSString *testData = @" 哈哈 ";
 //NSString *testData = @"ha  ";
 //NSString *testData = @"ha ni ha hehe wo ";
 //NSString *testData = @" 嘿嘿，你好 ";
 //NSString *testData = @"1      1         1             1 ";
 //NSString *testData = @" 哈哈 ";
 //NSString *testData = @"title111<a>222</a>333 77 7555444666";

//--------------------- 图文混合 -------------------------------//

//NSString *testData = @"水电费水电费<img src=\"http://img.baidu.com/hi/jx2/j_0025.gif\">谁的故事电饭锅<img src=\"/dynamic/upload1/image/20150729/1438130709982028464.jpg\" title=\"1438130709982028464.jpg\" alt=\"14.jpg\">山东省";

//--------------------- 纯文件 ---------------------------------//

//NSString *testData = @"<a class=\"file\" id=\"WU_FILE_0\" href=\"20_205553.png\" name=\"68477\" target=\"_blank\">2015-07-20_205553.png0%</a> ";

引入TFHpple第三方库效果

集成TFHpple库后，只需要调用以下三行代码，即可完成html5标签的解析。