我有两个包含数百万条记录(6000-1亿条记录)的数据库包(假设学生记录)
第一个模式是分段模式,第二个是目标prod模式,
在复制之前,我想检查分段模式中的相同用户是否已存在于prod模式中(如果存在,则应用一些合并逻辑)
我有一些PL/Sql代码按顺序运行并匹配记录,但是这个过程非常慢,即使在索引和性能调优时也是如此。
有没有可以使用的匹配器或多线程的pl/sql函数?在oracle中有没有更好的替代方案,我可能会错过?
一种可能的解决方案是从prod模式复制一些数据(参与复制过程的数据),并在分段模式中执行比较,但复制数据的开销可能与比较相同。
示例记录:
Student_first_name,Student_Last_name,SSN
foo, ,bar ,123456发布于 2015-09-29 14:13:33
首先,在模式之间复制数据不会提高性能,Oracle在模式内查询上的执行速度也不会更快。
其次-使用单个SQL来识别重复记录(或丢失的记录,以表中较小的部分为准),然后仅对这些行执行pl/sql代码可能会有很大帮助(通过将它们存储在游标中或使用专用列对它们进行闪存),特别是在每天添加的数据量与整个prod表相比微不足道的情况下。
https://stackoverflow.com/questions/32832610
复制相似问题