lxml

Parsing

Phân tích cú pháp XML & HTML

Tổng quan lxml

lxml là thư viện Python đầy đủ tính năng nhất để xử lý XML và HTML. Nó kết hợp những ưu điểm tốt nhất của libxml2 và libxslt với API Pythonic, cung cấp khả năng phân tích cú pháp cực nhanh, hỗ trợ XPath 1.0 đầy đủ, chuyển đổi XSLT và xử lý đáng tin cậy ngay cả các tài liệu không đúng định dạng.

PyRunbao gồm lxml thông qua phân phối góiPyodide. Bạn có thể phân tích cú pháp các chuỗi XML, chạy truy vấn XPath và điều hướng cây tài liệu hoàn toàn trong trình duyệt của mình — không cần cài đặt cục bộ libxml2 hoặc bất kỳ thư viện C nào khác.

Đầu ra mã & thực thi

Phân tích cú pháp XML và chạy các truy vấn XPath.

from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

Gói liên quan

Tài nguyên Python được đề xuất

Mở rộng kiến thức của bạn với các hướng dẫn tương tác, bảng ghi chú và so sánh mã có liên quan.