lxml

Parsing

XML ve HTML ayrıştırma

Genel Bakış lxml

lxml, XML ve HTML'yi işlemek için en kapsamlı özelliklere sahip Python kütüphanesidir. Libxml2 ve libxslt'nin en iyilerini Pythonic API ile birleştirerek son derece hızlı ayrıştırma, tam XPath 1.0 desteği, XSLT dönüşümleri ve hatalı biçimlendirilmiş belgelerin bile güvenilir şekilde işlenmesini sunar.

PyRun,Pyodidepaket dağıtımı aracılığıyla lxml'yi içerir. Tamamen tarayıcınızda XML dizelerini ayrıştırabilir, XPath sorgularını çalıştırabilir ve belge ağaçlarında gezinebilirsiniz; libxml2'nin veya başka herhangi bir C kütüphanesinin yerel kurulumuna gerek yoktur.

Kod ve Yürütme Çıkışı

XML'i ayrıştırın ve XPath sorgularını çalıştırın.

from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

İlgili Paketler

Önerilen Python Kaynakları

İlgili etkileşimli eğitimler, yardımcı sayfalar ve kod karşılaştırmalarıyla bilginizi genişletin.