|
|
1
5
解决方法是不使用正则表达式。他们没有足够的力量做这种事。 你想要的是 分析器 |
|
|
2
2
通常认为尝试用RegEx解析HTML/XML是不好的做法,因为它是分层的。您可以使用递归函数来实现这一点,但在这种情况下,更好的解决方案是使用真正的XML解析器。如果不知道你使用的平台,我就不能给你更好的建议。 编辑:Regex也非常慢,这是它不利于处理HTML的另一个原因;但是,我不知道XML/DOM处理器可能会更快,因为它可能会占用更多的内存。 如果您只想从一个简单的文档中获取数据(如您所演示的),并且/或者您想自己构建一个解决方案,那么这并不是很难做到的。只需构建一个简单的、基于递归状态的流处理器,它查找标记并将内容传递到下一个递归级别。 例如:
你必须自己检查错误,但是基本情况(当你返回到上一个级别时)只是在没有其他东西可以找到的时候。 也许这有帮助,也许没有。祝你好运。 |
|
3
0
您应该为此使用XML解析器。 |
|
|
user8144114 · 为商店的产品创建类 8 年前 |
|
|
LCaraway · 从列表合并数据集层次结构 8 年前 |
|
|
Matt Reichenbach · Excel动态分组/层次结构工具 8 年前 |
|
|
krynil · Power双柱状图中的钻取函数-显示日数而不是日期 8 年前 |
|
|
ProgrammingCuber · OpenCV层次结构始终为空 9 年前 |
|
|
Ashwin · 继承权的平面目录路径 9 年前 |