【发布时间】:2013-11-01 08:48:53
【问题描述】:
我有一个输入数据,其中包含 ID、上一个、当前和下一个节点(未排序)。 我必须在每个 ID 的第一页和最后一页之间找到一条路径,该路径涵盖了遍历的所有节点。 例如:如果我的输入数据是这样的: 第一列是 ID,第二列是 prev_node,第三列是当前节点,第四列是下一个节点。 Prev_node 为空的起始值,下一个节点为空的最后一个值
输入
id 上一个 当前下一个 1 a b c 1 a e f 1 a b g 1个 1 b c d 1 b g h 1 b o p 1 天 1 c b g 1天 1 e f e 1 e f f 1 f e f 1个 1个 1个 1克 1 h i j 1 h j 我 1 我我 1 我我 1 我 k l 1 我我 1 千升 1 升 1 升 1 百万 1个 1 点 1 次 1 q r 秒 1 r t 1个你 1个电视 1 u v w 1 宽 x 1 宽 x 1个输出应该是当前节点的路径,比如 -
识别电流 1个 1个 1摄氏度 1天 1个 1e 1 英尺 1e 1 英尺 1 英尺 1 英尺 1个 1个 1个 1克 1小时 1 我 1j 1j 1 我 1 我 1千 1升 1米 1个 1个 1个 1个 1个 1个 1个 1r 1 秒 1吨 1个 1 伏 1 瓦 1 个这里会有许多具有相似数据的 ID,我只显示了一个 ID(1)。同样在这里,我使用了实际上是 200-500 个字符长的字符串的字母。我尝试了几乎没有修改的 SQL 方法,如果 ID 的行数为 100 或以下,但它会为更多行提供字符串连接错误(即使在将长字符串转换为数字之后)。任何人都可以建议一种基于稳健程序的方法。我尝试了一些,但它不适用于超过 300 行的 ID。
我有时会遇到以下代码的错误是“字符串连接的结果太长”
我的代码
create or replace procedure pathing
as
type varr is table of varchar(4000);
visit varr;
t number;
--v varchar2(40);
fp varchar2(1000);
np varchar2(1000);
type stype is record(fp varchar2(1000),np varchar2(1000),t number);
type sinput is table of stype;
iarray sinput;
begin
select id
bulk collect into visit
from table_source
group by id
order by count(1) desc;
delete from table_final;
commit;
for k in visit.first .. visit.last loop
delete from table_temp;
commit;
insert into table_temp
select distinct prev_pg, page_id, next_pg, visit(k)
from table_source
where visit_id = visit(k)
order by prev_pg desc;
commit;
insert into table_final
WITH t_n AS (
SELECT prev_pg, page_id, next_pg, rownum n FROM table_temp
),
t_br AS (
SELECT
prev_pg,
page_id,
'<' || listagg(n, '|<') within GROUP(ORDER BY n) || '|' br,
COUNT(0) cnt
FROM
t_n
GROUP BY
prev_pg, page_id
),
t_mp AS (
SELECT
'|' || listagg(list) within GROUP(ORDER BY NULL) list
FROM (
SELECT REPLACE(br, '<') list FROM t_br WHERE cnt > 1
)
),
t_path(step, page_id, next_pg, used) AS (
SELECT 1, page_id, next_pg, ''
FROM t_n
WHERE prev_pg is null
UNION ALL
SELECT
step + 1,
t_br.page_id,
t_n.next_pg,
CASE
WHEN instr(list, '|' || n || '|') = 0
THEN used
ELSE used || n || '|'
END
FROM
t_mp,
t_path
JOIN t_br
ON next_pg = t_br.page_id AND t_path.page_id = prev_pg
JOIN t_n
ON n = regexp_substr(br, '^(<(' || used || '0)\|)*(<(\d+))?', 1, 1, '', 4)
) cycle step
SET is_cycle TO 'Y' DEFAULT 'N'
SELECT
page_id,
next_pg,
step,
visit(k)
FROM t_path
ORDER BY 1;
commit;
end loop;
end;
进一步解释我的示例:- 我想要每个 ID 的完整路径旅程,在示例中我以 ID 1 为例。对于 ID 1,我们有一组当前、上一个和下一个值。所以我们需要使用这些值找到路径。例如,对于 id 1,路径以“a”开头,因为 prev 列是空的。然后我们看到 a 的下一个值是 b 即当前是 a 并且下一个是 b 所以我们在 id 1 的所有行中搜索上一个值作为 a 和当前值作为 b ,在这一点上我们找到相同的我们取下一个行的值并重复该过程。例如这里 prev a , current b 和 next 是 c 所以我们再次搜索 prev b 和 current c 等等,直到我们得到完整路径,直到我们遇到 next as null 因为那将是最后一个
【问题讨论】:
-
请向我们展示您的 SQL 代码。
-
以下是我的程序:-
-
您能否提供另一个示例数据并准确解释应该做什么以及您期望的输出?也许是更简单的示例,以便更容易掌握您想要实现的目标。
-
在示例中,
f f f记录似乎开启了f的任意长字符串替换解决方案中的f f的可能性。如果e f f f a有效,为什么不是e f f a或e f f f f f f f f f f f a? -
我创建了一个小提琴来帮助那些想尝试的人。 Fiddle
标签: sql database oracle stored-procedures plsql