lxml

Parsing

XML 및 HTML 구문 분석

개요 lxml

lxml은 XML 및 HTML 처리를 위한 가장 완벽한 기능을 갖춘 Python 라이브러리입니다. libxml2 및 libxslt의 장점을 Pythonic API와 결합하여 매우 빠른 구문 분석, 전체 XPath 1.0 지원, XSLT 변환 및 잘못된 형식의 문서에 대한 안정적인 처리 기능을 제공합니다.

PyRun에는Pyodide패키지 배포를 통해 lxml이 포함되어 있습니다. XML 문자열을 구문 분석하고, XPath 쿼리를 실행하고, 브라우저에서 문서 트리를 탐색할 수 있습니다. libxml2나 다른 C 라이브러리를 로컬에 설치할 필요가 없습니다.

코드 및 실행 출력

XML을 구문 분석하고 XPath 쿼리를 실행합니다.

lxml XML Parser에디터에서 실행
from lxml import etree

xml_data = """
<bookstore>
  <book category="science">
    <title>A Brief History of Time</title>
    <author>Stephen Hawking</author>
    <price>12.99</price>
  </book>
  <book category="fiction">
    <title>1984</title>
    <author>George Orwell</author>
    <price>9.99</price>
  </book>
</bookstore>
"""

root = etree.fromstring(xml_data.strip())

print("All books:")
for book in root.findall("book"):
    title  = book.find("title").text
    author = book.find("author").text
    price  = float(book.find("price").text)
    print(f"  {title} by {author} — ${price:.2f}")

expensive = root.xpath("//book[price > 10]/title/text()")
print("\nBooks over $10:", expensive)

관련 패키지

권장 Python 리소스

관련 대화형 튜토리얼, 치트 시트, 코드 비교를 통해 지식을 확장하세요.