我已经对mysql数据库中的一个列执行了全文索引。我想使用regex过滤功能。我以为这两者是等价的。
>>> sum([bool(re.findall(r'\w+',p.abstract)) for p in Publication.objects.all()])
8467
>>> Publication.objects.filter(abstract__regex=r"\w+").count()
7974如果我使用更复杂的正则表达式,就会得到更多不同的结果。例如,\W{2}分别返回13和8039。我在这里错过了什么?显然,我对__regex的解释是不正确的。
编辑:
http://dev.mysql.com/doc/refman/5.1/en/regexp.html
来详述加雷斯的答案。Mysql有自己的一组转义规则。例如,[[:alpha:]]是mysql代表\w
发布于 2011-03-10 21:55:24
Django __regex过滤器使用底层数据库的regex工具,在您的示例中是MySQL。看来MySQL对你列出的正则表达式的解释与Python的不一样。(我认为-但我是基于一个简短的网络搜索,而不是任何更有原则的搜索,所以不要相信它-MySQL可能将\w简单地定义为w。)
https://stackoverflow.com/questions/5266264
复制相似问题