Синтаксический анализ текстового файла, содержащего уникальный шаблон, с помощью Python

#python #python-3.x #python-2.7

#python #python-3.x #python-2.7

Вопрос:

Как проанализировать текстовый файл, содержащий этот шаблон «КЛЮЧЕВОЕ СЛОВО: Out:» и сбросить результат в выходной файл с помощью Python?

input.txt

 DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf0000 In:0x80000000.1110ffff.
DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf00cc In:0x80000000.1110ffaa.
 

output.txt

 0xaaaf0000:1110ffff 
0x80000000:1110ffaa
 

Комментарии:

1. Где находится шаблон «КЛЮЧЕВОЕ СЛОВО: Вывод:» в вашем примере input.txt ? Я нигде не вижу Output

Ответ №1:

Вы могли бы использовать регулярное выражение:

 import re 

txt='''
DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf0000 In:0x80000000.1110ffff.
DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf00cc In:0x80000000.1110ffaa.'''

pat=r'KEYWORD: Out:(0x[a-f0-9] )[ t] In:0x[a-f0-9] .([a-f0-9] )'

>>> 'n'.join([m[0] ':' m[1] for m in re.findall(pat, txt)])
0xaaaf0000:1110ffff
0xaaaf00cc:1110ffaa
 

Если вы хотите выполнить это построчно из файла:

 import re

pat=r'KEYWORD: Out:(0x[a-f0-9] )[ t] In:0x[a-f0-9] .([a-f0-9] )'

with open(ur_file) as f:
    for line in f:
        m=re.search(pat, line) 
        if m:
            print(m.group(1) ':' m.group(2))
 

Комментарии:

1. Да, вы можете открыть файл и прочитать его вместо использования txt

Ответ №2:

 In [6]: lines
Out[6]:
['DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf0000 In:0x80000000.1110ffff.',
 'DEBUG 2020-11:11:17.401 KEYWORD: Out:0xaaaf00cc In:0x80000000.1110ffaa.']

In [7]: [x.split('Out:')[1].split(' ')[0]   ':'   x.split('In:')[1].split('.')[1] for x in lines]
Out[7]: ['0xaaaf0000:1110ffff', '0xaaaf00cc:1110ffaa']
 

Ответ №3:

Я думаю, что 2-я строка для вашего ‘output.txt «может быть неправильным (или сложным, если нет — вам нужно было бы указать на это).

В противном случае, возможно, регулярное выражение, подобное этому:

 (.*Out:)(0x[0-9a-f]{1,8}) In:0x[0-9a-f]{1,8}.([0-9a-f]{1,8}).
 

https://regex101.com/r/lMrR06/2