问题描述
我插入数据到非分区表包含的数据250M记录。但是,从源系统表插入数据的时间太长,而不同数据库中的表具有相同数量的数据。
我想知道不同的加载方法,我可以使用这些方法来加速数据加载过程。
源表分区为年,子分区为月。
目标表未分区。
源表和目标表是相同的结构
每天夜间将增量数据从源表加载到用于报告的DWH目标表。
我想知道不同的加载方法,我可以使用这些方法来加速数据加载过程。
源表分区为年,子分区为月。
目标表未分区。
源表和目标表是相同的结构
每天夜间将增量数据从源表加载到用于报告的DWH目标表。
专家解答
表中*已*的行数并不重要- -真正重要的是要加载的行数。
话虽如此,即使2.5亿行也不是要加载到表中的“海量”数据量,因此如果加载时间较长,最可能的罪魁祸首是
a)表中的索引数,和/或
b)装载机构
所以要考虑的是
1考虑直接加载(即,插入/*+附录*/ ).注意这将锁定表
2)看看表中有哪些索引,以及它们是否都是实际需要的。或者你是否可以在装载之前标记它们为不可靠,然后在装载之后重建它们。
但最终...如果数据量预期会增长,则确实需要考虑分区(手动或使用分区选项)
话虽如此,即使2.5亿行也不是要加载到表中的“海量”数据量,因此如果加载时间较长,最可能的罪魁祸首是
a)表中的索引数,和/或
b)装载机构
所以要考虑的是
1考虑直接加载(即,插入/*+附录*/ ).注意这将锁定表
2)看看表中有哪些索引,以及它们是否都是实际需要的。或者你是否可以在装载之前标记它们为不可靠,然后在装载之后重建它们。
但最终...如果数据量预期会增长,则确实需要考虑分区(手动或使用分区选项)
「喜欢这篇文章,您的关注和赞赏是给作者最好的鼓励」
关注作者
【版权声明】本文为墨天轮用户原创内容,转载时必须标注文章的来源(墨天轮),文章链接,文章作者等基本信息,否则作者和墨天轮有权追究责任。如果您发现墨天轮中有涉嫌抄袭或者侵权的内容,欢迎发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。




