Padrões avançados de Regex

Grupos nomeados, lookaheads e correspondência difusa.

Experimente no Editor

Visão geral

O pacote regex atua como um substituto para o re integrado do pythons.

Isso oferece suporte extensivo a árvores de pesquisa difusas e dictos de agrupamento nomeados isolados prontos para uso.

Saída de código e execução

Analisa um layout de log de segurança e executa 1 correspondência difusa de substituição.

import regex

# Named capture groups — parse a log line
log = "2025-07-04 14:32:01 ERROR  [auth] Login failed for user@example.com"
pattern = r"(?P<date>\d{4}-\d{2}-\d{2}) (?P<time>\d{2}:\d{2}:\d{2}) (?P<level>\w+)\s+\[(?P<module>\w+)\] (?P<message>.+)"
m = regex.match(pattern, log)
if m:
    print("Match Breakdown:")
    for k, v in m.groupdict().items():
        print(f"  {k:<10}: {v}")

# Fuzzy matching (allows 1 substitution)
print("\nFuzzy search for 'colour' (≤1 error):")
text = "I prefer colour and cilor and colouur"
for hit in regex.finditer(r"(?:colour){s<=1}", text):
    print(f"  found '{hit.group()}' at {hit.span()}")
Saída terminal
Match Breakdown:
  date      : 2025-07-04
  time      : 14:32:01
  level     : ERROR
  module    : auth
  message   : Login failed for user@example.com

Fuzzy search for 'colour' (≤1 error):
  found 'colour' at (9, 15)
  found 'colouur' at (30, 37)

Implementação passo a passo

  • Regex analisando dados de texto
  • Raspagem difusa de toras
  • Padrões de normalização de strings

Perguntas frequentes

Tópicos Relacionados