regex

Parsing

Công cụ biểu thức chính quy nâng cao

Tổng quan regex

Mô-đun biểu thức chính quy là một sự thay thế tùy ý cho mô-đun re tích hợp sẵn của Python, cung cấp các tính năng bổ sung bao gồm đối sánh mờ (khớp chuỗi gần đúng), giao diện có chiều rộng thay đổi, các nhóm chụp được đặt tên với các lần chụp lặp lại, các lớp ký tự POSIX và nhóm nguyên tử.

Regex có sẵn trongPyRunqua micropip. Nó đặc biệt hữu ích khi bạn cần khớp các mẫu có lỗi chính tả nhẹ (khớp mờ), làm việc với văn bản Unicode phức tạp hoặc sử dụng các tính năng biểu thức chính quy không được hỗ trợ trong mô-đun re tiêu chuẩn.

Đầu ra mã & thực thi

Các nhóm chụp được đặt tên và khớp mẫu mờ.

Regex: Named Groups & FuzzyChạy trong Trình chỉnh sửa
import regex

# Named capture groups — parse a log line
log = "2025-07-04 14:32:01 ERROR [auth] Login failed for user@example.com"
pattern = r"(?P<date>\d{4}-\d{2}-\d{2}) (?P<time>\d{2}:\d{2}:\d{2}) (?P<level>\w+) \[(?P<module>\w+)\] (?P<message>.+)"
m = regex.match(pattern, log)
if m:
    for k, v in m.groupdict().items():
        print(f"  {k:<10}: {v}")

# Fuzzy matching — find 'colour' with up to 1 error
print("\nFuzzy search (≤1 substitution):")
text = "I prefer colour and cilor and colouur"
for hit in regex.finditer(r"(?:colour){s<=1}", text):
    print(f"  found '{hit.group()}' at {hit.span()}")

Gói liên quan

Tài nguyên Python được đề xuất

Mở rộng kiến thức của bạn với các hướng dẫn tương tác, bảng ghi chú và so sánh mã có liên quan.