代码之家  ›  专栏  ›  技术社区  ›  Maciek Sawicki

在Ruby中从字符串中删除XML实体

  •  0
  • Maciek Sawicki  · 技术社区  · 16 年前

    不幸的是,我在node中收到了很多垃圾:

     <description>&lt;p&gt;
    some decryption
    
    &lt;/p&gt;
     &lt;a href="http://url.com/trac/xxx/wiki/foo?action=diff&amp;amp;version=28"&gt;(diff)&lt;/a&gt;</description>
    

    我需要检索文本(“一些描述”)和可选的网址。

    最好的方法是什么?Regexp(如果这是答案,你能举个例子吗?)?

    1 回复  |  直到 16 年前
        1
  •  3
  •   Chirantan    16 年前

    <a></a> ).以下代码应该可以工作。

    require 'cgi'
    description = "&lt;/p&gt; &lt;a href=\"http://url.com/trac/xxx/wiki/foo?action=diff&amp;amp;version=28\"&gt;(diff)&lt;/a&gt;"
    CGI.unescapeHTML(description) # => </p> <a href="http://url.com/trac/xxx/wiki/foo?action=diff&amp;version=28">(diff)</a>