【问题标题】:Using an order by case in a sub-query在子查询中使用按案例排序
【发布时间】:2013-04-02 18:11:37
【问题描述】:

每个时间表都有许多坡道,每个坡道都有一个end_date

我需要列出我的所有坡道,以及一个包含坡道 ID 的额外字段以及该时间表的最新结束日期。我还需要能够在我的WHERE 子句中使用这个额外的字段。

这通常是使用MAX 函数的子查询的情况,除了一个问题:斜坡的end_date 字段可以为空,表示斜坡是当前的。因此,SELECT MAX(end_date) 不起作用,因为 null 值比非空值“小”。

到目前为止,这是我想出的:

SELECT r1.*,
    (SELECT r2.id
    FROM ramp as r2
    WHERE schedule_id = r.schedule_id
    ORDER BY IF(end_dte is NULL, '9999-99-99', end_dte) DESC
    LIMIT 1) as latestId
FROM ramp as r1

这会产生这张表,这正是我想要的:

+-------+-------------+------------+-----------------+--------+------------+------------+----------+
| id    | schedule_id | suppr_flag | comment         | months | start_dte  | end_dte    | latestId |
+-------+-------------+------------+-----------------+--------+------------+------------+----------+
|    16 |           7 | NULL       | NULL            |   NULL | 2008-06-23 | NULL       |       16 |
|    15 |           6 | NULL       | NULL            |   NULL | 2007-05-01 | 2007-12-31 |       15 |
|    13 |           5 | NULL       | 1-15 deals      |   NULL | 2004-08-11 | NULL       |       13 |
|    11 |           4 | NULL       | NULL            |   NULL | 2005-08-11 | NULL       |       11 |
|    12 |           4 | NULL       | NULL            |     12 | 2004-08-11 | 2005-08-10 |       11 |
|    17 |          13 | NULL       | NULL            |      6 | 2009-03-05 | 2009-09-04 |       19 |
|    18 |          13 | NULL       | NULL            |      6 | 2009-09-05 | 2010-03-04 |       19 |
|    19 |          13 | NULL       | NULL            |   NULL | 2010-03-05 | NULL       |       19 |
|    20 |          14 | NULL       | NULL            |     12 | 2001-06-18 | 2008-06-17 |       20 |

除非我不能在 WHERE 子句中使用 latestId(它是未知列)。

你有什么想法吗?

【问题讨论】:

    标签: mysql sql


    【解决方案1】:

    一个快速的解决方案是在 ORDER BY 子句上重复整个查询,因为在那里看不到别名,但我不太喜欢查询的外观:

    SELECT r1.*,
        (SELECT r2.id
        FROM ramp as r2
        WHERE schedule_id = r1.schedule_id
        ORDER BY IF(end_dte is NULL, '9999-99-99', end_dte) DESC
        LIMIT 1) as latestId
    FROM ramp as r1
    ORDER BY
        (SELECT r2.id
        FROM ramp as r2
        WHERE schedule_id = r1.schedule_id
        ORDER BY IF(end_dte is NULL, '9999-99-99', end_dte) DESC
        LIMIT 1);
    

    或者您可以从原始查询中选择,然后对结果进行排序:

    SELECT s.*
    FROM (
      SELECT r1.*,
          (SELECT r2.id
          FROM ramp as r2
          WHERE schedule_id = r1.schedule_id
          ORDER BY IF(end_dte is NULL, '9999-99-99', end_dte) DESC
          LIMIT 1) as latestId
      FROM ramp as r1
    ) s
    ORDER BY s.latestId
    

    但如果我理解您的逻辑正确,您可以使用此查询来获取每个 schedule_id 的最大 end_dte

    SELECT schedule_id, MAX(COALESCE(end_dte, '9999-12-31')) max_dte
    FROM ramp
    GROUP BY schedule_id;
    

    然后您可以再次使用 ramp 加入此查询以获取与最大 end_dte 关联的 ID。在 ON 子句中,您将需要再次使用 COALESCE:

    SELECT r1.schedule_id, r2.id as latestId
    FROM (
      SELECT schedule_id, MAX(COALESCE(end_dte, '9999-12-31')) max_dte
      FROM ramp
      GROUP BY schedule_id) r1 INNER JOIN
      ramp r2
      ON r1.max_dte = COALESCE(r2.end_dte, '9999-12-31')
         AND r1.schedule_id = r2.schedule_id
    

    然后你可以再次加入这个以获得你需要的结果:

    SELECT ramp.*, m.latestId
    FROM
      ramp INNER JOIN (
        SELECT r1.schedule_id, r2.id as latestId
        FROM (
          SELECT schedule_id, MAX(COALESCE(end_dte, '9999-12-31')) max_dte
          FROM ramp
          GROUP BY schedule_id) r1 INNER JOIN
          ramp r2
          ON r1.max_dte = COALESCE(r2.end_dte, '9999-12-31')
             AND r1.schedule_id = r2.schedule_id
          ) m ON ramp.schedule_id = m.schedule_id
    ORDER BY
      latestId
    

    请看小提琴here。请注意,我使用的是 '9999-12-31' 而不是 '9999-99-99',第一个是有效日期,第二个不是。

    编辑

    如果您还希望考虑多个schedule_id 共享相同的最大日期这一事实,并且在这种情况下您只需要最新(最大)ID,则可以使用 GROUP BY 查询和 MAX 聚合功能:

    SELECT r1.schedule_id, MAX(r2.id) as latestId
    FROM (
      SELECT schedule_id, MAX(COALESCE(end_dte, '9999-12-31')) max_dte
      FROM ramp
      GROUP BY schedule_id) r1 INNER JOIN
      ramp r2
      ON r1.max_dte = COALESCE(r2.end_dte, '9999-12-31')
         AND r1.schedule_id = r2.schedule_id
    GROUP BY
      r1.schedule_id
    

    并且您在主查询中使用此更新版本。

    【讨论】:

    • 真的很棒。我不知道您可以进行嵌套内连接 - 我尝试了嵌套子查询,但它要么崩溃要么不可能。
    • 出于某种原因,我得到了两行具有不同 latestId 值的行。我正在做一些其他的连接。有什么想法吗?
    • @SamSelikoff 我认为对于相同的end_dte,可能有不止一行具有相同的最大值schedule_id ...如果这是问题所在,您只想要最大ID吗?
    • 啊,是的,我明白了。这是一个数据完整性问题(这很好,它指出了错误)。如果我只想要最大 ID,我会怎么做?谢谢顺便说一句,你摇滚。
    • @SamSelikoff 谢谢 :) 你可以使用 GROUP BY 和 MAX 聚合函数,我更新了我的答案..我还在开始时添加了一个查询,这只是一个不同的想法......我希望最终的查询是您正在寻找的!
    【解决方案2】:

    您可以在订单中使用两列...首先是非空指示标志,然后是日期。改变你的...

    ORDER BY IF(end_dte is NULL, '9999-99-99', end_dte) DESC
    

    ORDER BY
       IF( end_dte is null, 1, 2 ),
       end_dte DESC
    

    这样,它将所有“NULL”结束日期推到列表的顶部(通过 IF() 值将是 1 对 2 对于任何其他有日期的),然后,按日期降序

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2013-07-05
      • 2019-01-02
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-06-01
      • 1970-01-01
      相关资源
      最近更新 更多