代码之家  ›  专栏  ›  技术社区  ›  akosch

如何从lxml中获取原始xml?

  •  7
  • akosch  · 技术社区  · 15 年前

    我使用以下代码定位一个DIV:

    parser = etree.HTMLParser()
    tree = etree.parse(StringIO(page), parser)
    
    div = tree.xpath("//div[@class='content']")[0]
    

    我唯一的问题是,这样做之后,我不想依赖lxml来提取所说的DIV的内容:我只想返回DIV包含的原始XML。这是可行的还是必须完全放弃这种方法?

    2 回复  |  直到 15 年前
        1
  •  11
  •   unutbu    15 年前

    我想你在找:

    etree.tostring(div)
    
        2
  •  2
  •   Ryan Ginstrom    15 年前

    你试过了吗 tostring ?

    raw_xml = etree.tostring(div)