我有一个充满字符串的数据库,例如:
as.web.product.viewed(AT)2018-01-28T19:00:52.032Z(THEN)as.web.product.viewed(AT)2018-01-28T19:02:20.132Z
(另一个可能的分隔符是“(WITH)”,动作as.web.product.purchased
非常理想,我需要一个尽可能通用的解决方案)
一个序列中可以有任意数量的动作,并且或多或少是任意顺序。我需要能够隔离动作名称(例如as.web.product.viewed
)和它发生的时间,并保持动作的顺序。
这样做的最 Python 式的方式是什么?
编辑:所需的输出(对于上面的示例)- 2 个列表,例如:
['as.web.product.viewed','as.web.product.viewed']
['2018-01-28T19:00:52.032Z','2018-01-28T19:02:20.132Z']
当出现圆括号中的文本时,您可以使用正则表达式来拆分字符串:
import re
pat = re.compile('''\([A-Za-z]+\)''')
s = "as.web.product.viewed(AT)2018-01-28T19:00:52.032Z(THEN)as.web.product.viewed(AT)2018-01-28T19:02:20.132Z"
r = (re.split(pat, s))
print (list(zip(r[::2], r[1::2]))) # group pairwise if needed !
这将返回:
[('as.web.product.viewed', '2018-01-28T19:00:52.032Z'), ('as.web.product.viewed', '2018-01-28T19:02:20.132Z')]
本文收集自互联网,转载请注明来源。
如有侵权,请联系 [email protected] 删除。
我来说两句