我有一个MYSQL表,大约有5000万行(预计还会增长)。现在我需要遍历整个表。我正在尝试以块为单位进行迭代,即,获取N行,处理,获取另外N行
表的主键为自增整数ID。这将使迭代变得更容易。我的问题是:哪条语句会更快(其中是一种循环计数器):
SELECT * FROM table WHERE ID IN (i, i+1, ..., i+N)或
SELECT * FROM table WHERE ID >= i AND ID < i + N第一个使用IN子句,它在主键上进行查找,我认为这是相当快的。第二个有一个小于than+greater的条件,对于一个非索引列来说,这个条件会很慢。但是因为我是在主键上做的,所以我不确定性能。
其中哪一个应该提供更好的性能,比如N = 1000
发布于 2015-03-11 13:09:19
使用这个:
SELECT * FROM table WHERE ID >= $i AND ID < $i + $N“范围扫描”很高兴找到第一行(在$i),然后获得下一行,下一行,……这是非常有效的。
然而,这确实假设ID是密集的。如果您删除了很多行,则可能不是每次都使用$N行。(是的,你可以说这无关紧要。)
$N = 1000 --这是一个合理的数字--您不会花费“太长时间”,也不会“阻塞”太多行。等。
有关其他技术(例如,当它不密集时),请参见my blog on deleting in chunks。
https://stackoverflow.com/questions/28978763
复制相似问题