|
|
1
3
使用类似的库 Tidy 或 HTMLPurifier 为您修复损坏的HTML。 |
|
|
2
0
对于初学者,插入符号“^”将否定整个字符类。字符类具有隐含或语句,这是字符类的要点,因此可以将类缩短为[^'“>] 至于为什么你只得到了“something=b”标签,我相信你的角色课之后就缺少了a+。 所以我修改的regexp是:
注意组结束后的空格 |
|
|
3
0
您可以使用分隔符和x修饰符来尝试此操作。我已经对它进行了格式化,这样它更可读。 |
|
4
0
在你的正则表达式中
如果属性值可以具有以下特性,那么编写一个regex来捕获给定xmlish标记中所有格式错误的属性是很困难的
例如:
您的regex尝试在一个步骤中从整个字符串中提取所有属性-它查找
您可以在一个步骤中提取左括号和右括号的内容,然后在其中查找属性。正则表达式
如果它们也可以包含空格,则需要更多的前瞻性内容:
|