lxml

Parsing

Penguraian XML & HTML

Ikhtisar lxml

lxml adalah pustaka Python terlengkap dengan fitur untuk memproses XML dan HTML. Ini menggabungkan yang terbaik dari libxml2 dan libxslt dengan API Pythonic, menawarkan penguraian yang sangat cepat, dukungan penuh XPath 1.0, transformasi XSLT, dan penanganan dokumen yang cacat sekalipun.

PyRunmenyertakan lxml melalui distribusi paketPyodide. Anda dapat mengurai string XML, menjalankan kueri XPath, dan menavigasi pohon dokumen sepenuhnya di browser Anda — tidak diperlukan instalasi lokal libxml2 atau pustaka C lainnya.

Kode & Output Eksekusi

Parsing XML dan jalankan kueri XPath.

lxml XML ParserJalankan di Editor
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

Paket Terkait

Sumber Daya Python yang Direkomendasikan

Perluas pengetahuan Anda dengan tutorial interaktif terkait, lembar contekan, dan perbandingan kode.