lxml

Parsing

XML 和 HTML 解析

概述 lxml

lxml 是用來處理 XML 和 HTML 的功能最齊全的 Python 函式庫。它將 libxml2 和 libxslt 的優點與 Pythonic API 結合,提供極快的解析、完整的 XPath 1.0 支援、XSLT 轉換以及對格式錯誤文件的可靠處理。

PyRun透過Pyodide套件分發包含 lxml。您可以完全在瀏覽器中解析 XML 字串、執行 XPath 查詢以及導覽文件樹 — 無需在本機安裝 libxml2 或任何其他 C 函式庫。

程式碼和執行輸出

解析 XML 並執行 XPath 查詢。

lxml XML Parser在編輯器中執行
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

相關套餐

推薦的 Python 資源

透過相關的互動式教學、備忘單和程式碼比較來擴展您的知識。