lxml

Parsing

Analiza XML i HTML

Przegląd lxml

lxml to najbardziej kompletna biblioteka Pythona do przetwarzania XML i HTML. Łączy w sobie to, co najlepsze w bibliotekach libxml2 i libxslt z interfejsem API języka Python, oferując niezwykle szybkie analizowanie, pełną obsługę XPath 1.0, transformacje XSLT i niezawodną obsługę nawet zniekształconych dokumentów.

PyRunzawiera lxml poprzez dystrybucję pakietuPyodide. Możesz analizować ciągi XML, uruchamiać zapytania XPath i nawigować po drzewach dokumentów całkowicie w przeglądarce — nie jest wymagana lokalna instalacja libxml2 ani żadnej innej biblioteki C.

Dane wyjściowe kodu i wykonania

Analizuj XML i uruchamiaj zapytania XPath.

lxml XML ParserUruchom w Edytorze
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

Powiązane pakiety

Polecane zasoby Pythona

Poszerzaj swoją wiedzę dzięki powiązanym interaktywnym samouczkom, ściągawkom i porównaniom kodów.