lxml

Parsing

Analyse XML et HTML

Aperçu lxml

lxml est la bibliothèque Python la plus complète en fonctionnalités pour le traitement du XML et du HTML. Il combine le meilleur de libxml2 et libxslt avec une API Pythonic, offrant une analyse extrêmement rapide, une prise en charge complète de XPath 1.0, des transformations XSLT et une gestion fiable des documents même mal formés.

PyRuninclut lxml via la distribution du packagePyodide. Vous pouvez analyser des chaînes XML, exécuter des requêtes XPath et parcourir les arborescences de documents entièrement dans votre navigateur — aucune installation locale de libxml2 ou de toute autre bibliothèque C n'est requise.

Sortie de code et d'exécution

Analysez XML et exécutez des requêtes XPath.

from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

Forfaits associés

Ressources Python recommandées

Développez vos connaissances avec des didacticiels interactifs, des aide-mémoire et des comparaisons de codes associés.