lxml

Parsing

XML- und HTML-Analyse

Übersicht lxml

lxml ist die funktionsreichste Python-Bibliothek zur Verarbeitung von XML und HTML. Es kombiniert das Beste von libxml2 und libxslt mit einer Pythonic-API und bietet extrem schnelles Parsen, vollständige XPath 1.0-Unterstützung, XSLT-Transformationen und eine zuverlässige Verarbeitung selbst fehlerhafter Dokumente.

PyRunenthält lxml über die PaketverteilungPyodide. Sie können XML-Strings analysieren, XPath-Abfragen ausführen und durch Dokumentbäume navigieren – vollständig in Ihrem Browser – keine lokale Installation von libxml2 oder einer anderen C-Bibliothek erforderlich.

Code- und Ausführungsausgabe

Analysieren Sie XML und führen Sie XPath-Abfragen aus.

lxml XML ParserIm Editor ausführen
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

Verwandte Pakete

Empfohlene Python-Ressourcen

Erweitern Sie Ihr Wissen mit zugehörigen interaktiven Tutorials, Spickzetteln und Codevergleichen.