|
|
1
5
由于以下几个原因,您将面临非常困难的时间:
这项工作几乎和为浏览器编写渲染引擎一样复杂。你也许能够处理一些特定的案例,但即使在那里,你的成功率也只是偶然的。 编辑: 考虑到您非常具体的功能集,我可以给您一些关于实现的建议: 在查找style属性的值时,您希望不区分大小写并使用非贪婪匹配,即:
所以你只能找到下一个双引号的内容,而不是上一个双引号的整个内容。此外,如果未找到匹配项,您可能希望跳过该行,因此:
为了分析内脏,我会使用
当然,在Perl中有一些标准的咒语,比如总是使用严格和警告,尝试使用命名匹配,而不是
|
|
|
2
3
看看 CPAN 对于HTML解析模块,如 HTML::TreeBuilder , HTML::DOM XML::LibXML . 下面是使用HTML::TreeBuilder的快速示例,其中添加了 属性设置为具有 边境 内容:
border=“1” 刚刚添加到 跨度 标签 |
|
|
3
2
我不知道你对专有软件的立场,但是 PrinceXML 是最好的HTML到PDF转换器可用。 |
|
|
Carsten · 使用最近的搜索模式更改文本块 1 年前 |
|
|
A.Ellett · 测试-t STDIN与-t<STDIN> 2 年前 |
|
|
con · 如何跳转到foreach迭代的特定点? 2 年前 |