我在为以下代码编写正则表达式时遇到麻烦。我有一个文字向量(请参见RE_LIT),我想在一行文本中找到所有向量,但是我很难编写正则表达式。具体来说,我似乎对括号作为组而不是括号有问题。

RE_LABEL1 = r'[cvx]\d+(?![.]r)$'
RE_LABEL2 = r'v\d+\.r\d+'
RE_LABEL = r'(%s)|(%s)' % (RE_LABEL1, RE_LABEL2)
RE_LIT = r'!?%s' % RE_LABEL
RE_VEC = r'\[\s*(\s*%s\s*,?\s*)+\s*\]' % RE_LIT


匹配的示例字符串:

test = 'c1 = blah([v3,v4,v5.r1,!v6,v7,x8,v9,v10], [v1, v2], [x5.r1])'


预期成绩:

> print re.findall(RE_VEC, test)
['[v3,v4,v5.r1,!v6,v7,x8,v9,v10]', '[v1, v2]']


提前谢谢您的帮助。

最佳答案

您可以使用以下修复程序:

import re
RE_LABEL1 = r'[cvx]\d+(?![.]r)'
RE_LABEL2 = r'v\d+\.r\d+'
RE_LABEL = r'%s|%s' % (RE_LABEL1, RE_LABEL2)
RE_LIT = r'\!?%s),?\s*' % RE_LABEL
RE_VEC = r'(?:(?:%s)+' % RE_LIT
test = '[v3,v4,v5.r1,!v6,v7,x8,v9,v10], [v1, v2]'
print re.findall(RE_VEC, test)


IDEONE demo的输出:

['v3,v4,v5.r1,!v6,v7,x8,v9,v10', 'v1, v2']

关于python - 嵌套正则表达式字符串,我们在Stack Overflow上找到一个类似的问题:https://stackoverflow.com/questions/29930207/

10-12 22:52