【发布时间】:2013-02-28 21:24:42
【问题描述】:
我正在尝试优化以下 SQL,但我对 SQL 优化的了解还很浅,而且我没有取得太大进展。(由于公司政策,我概括了列和其他标识符)在当前状态下,此 SQL需要 1 到 2 分钟才能运行,具体取决于负载。 VKTINFO 表包含大约 100 万条记录,GNTINFO 表包含大约 300 万条记录。如果这是一个批处理过程,通常 1-2 分钟不会有什么大不了的,但我们有代理需要这些信息,并且尽快 - 更糟糕的是,我们的系统最终会超时并返回一个抱歉的错误用户。但是,延长超时窗口不是一种选择。我们还有其他搜索条件,例如名字、邮政编码、帐户类型、帐户状态等,但是当执行如下广泛搜索时,查询会变得相当慢。
如果有任何关于如何操纵此 SQL 以加快选择速度的建议/技术,我将非常感谢您对此事的任何想法。如果需要更多信息,我很乐意提供符合我们公司政策的尽可能多的信息。
编辑: 这里要求的是 VKTINFO 和 GNTINFO 表的索引。
- account_number
- expiration_date
- 有效日期
gnt_account_info 和 vkt_account_info 的索引:
- pi_account_num
- pi_policy_num_gid
gntnad 和 vktnad 表的索引:
- nad_account_number
- nad_name_type
gntpolrf 和 vktpolrf 表的索引:
- xrf_account_number
select
processing_system,
total_premium,
quote_by,
email_address,
account_number,
expiration_date,
account_state,
xrf_file,
customer_name
from
(
select
'ABCD' as processing_system,
total_premium,
quote_by,
email_address,
account_number,
expiration_date,
account_state,
xrf_file,
customer_name
from vktinfo
left outer join vkt_account_info on account_number = pi_account_number
left outer join vktpolrf on account_number = xrf_account_number
left outer join VKTNAD on account_number = nad_account_number
and history_expiration_date=nad_history_expiration_date
and nad_name_type='HA'
WHERE effective_date >= '2013-02-01'
AND effective_date <= '2013-02-28'
AND customer_name like '_SMITH%'
AND account_state = 'South Carolina'
union all
select
'EFGH' as processing_system,
total_premium,
quote_by,
email_address,
account_number,
expiration_date,
account_state,
xrf_file,
customer_name
from gntinfo
left outer join gnt_account_info on account_number = pi_account_number
left outer join vktpolrf on account_number = xrf_account_number
left outer join GNTNAD on account_number = nad_account_number
and history_expiration_date=nad_history_expiration_date
and nad_name_type='HA'
WHERE effective_date >= '2013-02-01'
AND effective_date <= '2013-02-28'
AND customer_name like '_SMITH%'
AND account_state = 'South Carolina'
)
a
order by customer_name ASC fetch first 1000 rows only WITH UR
【问题讨论】:
-
请发布(添加到问题中)您拥有的索引。
-
您可以将执行计划粘贴到您的问题中吗?联合 SELECT 语句中的 WHERE 子句是相同的;值得测试优化器是否会通过从子查询中删除两个 WHERE 子句并将其中一个粘贴到外部查询中来做出更好的决策。不过先看看执行计划。
-
“effective_date”和“nad_name_type”在哪些表中?这些表可能能够使用内连接而不是左连接。
-
同意 Mike 的观点,为了清楚你之后的任何人,或者你试图获得帮助的人,在对其他表进行任何连接时,你应该始终将列称为 table.field,以便其他人可以提供帮助,例如这种情况。将与各个列关联的表上的复合索引作为 JOIN 的一部分会得到更好的优化。
-
"order by customer_name" 如果您在此列上没有索引,将需要 O(n log(n)) 时间(其中 n 是应用“前 1000 个”之前结果集的大小",这可能不是问题,当然取决于结果集的大小......)
标签: java sql db2 query-optimization