lxml

Parsing

XML 和 HTML 解析

概述 lxml

lxml 是用于处理 XML 和 HTML 的功能最齐全的 Python 库。它将 libxml2 和 libxslt 的优点与 Pythonic API 相结合,提供极快的解析、完整的 XPath 1.0 支持、XSLT 转换以及对格式错误文档的可靠处理。

PyRun通过Pyodide包分发包含 lxml。您可以完全在浏览器中解析 XML 字符串、运行 XPath 查询以及导航文档树 — 无需在本地安装 libxml2 或任何其他 C 库。

代码和执行输出

解析 XML 并运行 XPath 查询。

lxml XML Parser在编辑器中运行
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

相关套餐

推荐的 Python 资源

通过相关的交互式教程、备忘单和代码比较来扩展您的知识。