【问题标题】:Compare two SQL queries result sets比较两个 SQL 查询结果集
【发布时间】:2015-09-18 18:30:52
【问题描述】:

所以我有一个应用程序可以根据一些定义的答案检查 SQL SELECT 查询。

现在它使用 PHP 的一些 FOR 循环比较两个查询的结果集。它从 defined 查询中搜索每一列,并尝试在 input 查询中找到它;

有没有办法在 oracle 级别检查这个?

示例:假设我们有下表

 EMPNO ENAME      JOB              MGR HIREDATE         SAL       COMM     DEPTNO

  7369 SMITH      CLERK           7902 17-DEC-80        800                    20
  7499            SALESMAN        7698 20-FEB-81       1600        300         30
  7521 WARD       SALESMAN        7698 22-FEB-81       1250        500         30
  7566 JONES      MANAGER         7839 02-APR-81       2975                    20
  7654 MARTIN     SALESMAN        7698 28-SEP-81       1250       1400         30
  7698 BLAKE      MANAGER         7839 01-MAY-81       2850                    30
  7782 CLARK      MANAGER         7839 09-JUN-81       2450                    10
  7788 SCOTT      ANALYST         7566 13-JUL-87       3000                    20
  7839 KING       PRESIDENT            17-NOV-81       5000                    10
  7844 TURNER     SALESMAN        7698 08-SEP-81       1500          0         30
  7876 ADAMS      CLERK           7788 13-JUL-87       1100                    20
  7900 JAMES      CLERK           7698 03-DEC-81        950                    30
  7902 FORD       ANALYST         7566 03-DEC-81       3000                    20
  7934 MILLER     CLERK           7782 23-JAN-82       1300                    10

定义的答案:

 SELECT ENAME, JOB FROM EMP WHERE DEPTNO=20;

输入答案:

SELECT * FROM EMP WHERE DEPTNO=20;

这两个查询在所选行方面或多或少是等效的。

我如何检查这个事实?

  1. (就行而言,这 2 个查询是等效的)
  2. (输入查询可能有额外的列)

我尝试过的:

  1. 使用 UNION/MINUS 运算符。 (问题是当查询有不​​同数量的列时,MINUS 不起作用)。

有什么建议吗?

提前致谢。

【问题讨论】:

  • 在所选行方面更多或更少等价?不,如果同时运行,它们在所选行方面完全等效。除非您在查询运行之间插入或删除。这是你的场景吗?
  • 如果您使用 SQL Server,您可以使用 sys.dm_exec_describe_first_result_set 获取有关查询的元数据并比较输入/答案。检查Oracle中是否有类似的东西。
  • 只有 SELECT 操作。我想用它进行某种测试。有一个问题,用户输入答案(查询),然后我根据正确的答案(查询)检查它。

标签: php sql oracle plsql


【解决方案1】:

这在某种程度上取决于您愿意依靠您的应用程序提供哪些信息,以及您希望动态提取哪些信息。这还取决于您打算如何向 Oracle 提出问题。

如果您的想法是您将构建一个包含参考查询和输入查询的查询,并告诉您它们是否对应,并且您是否愿意依赖应用程序提供显式列列表,以及如果其中一个您要检查的是结果集列标签,如果您不关心列或行顺序,那么您可以这样做:

WITH
  expected AS (
    -- select all the expected columns, plus a count
    SELECT ENAME, JOB, COUNT(*) AS count FROM (
      -- the standard query to test against
      SELECT ENAME, JOB FROM EMP WHERE DEPTNO=20
    ) reference
    -- group by all the columns of the result
    GROUP BY ENAME, JOB
  ),
  observed AS (
    -- choose only the expected columns (Oracle will barf if any are not present),
    -- plus a count
    SELECT ENAME, JOB, COUNT(*) AS count FROM (
      -- the query whose results are to be tested
      SELECT * FROM EMP WHERE DEPTNO=20
    ) user_specified
    -- group by all the columns of the reference result
    GROUP BY ENAME, JOB
  )
SELECT COUNT(*) as differences
FROM (
    (
      SELECT * FROM expected
      MINUS
      SELECT * FROM observed
    )
    UNION ALL
    (
      SELECT * FROM observed
      MINUS
      SELECT * FROM expected
    )
  ) differing_rows

这在很大程度上是样板文件。您将整个参考查询插入一个位置,将整个输入查询插入另一个位置,并将(相同的)预期列列表插入四个不同的位置。如果查询结果与感兴趣的列完全匹配(忽略列和行顺序),则查询结果是单行,单列包含值 0,否则为大于零的值。如果任一组件查询返回重复行,则总体结果会测试两者是否返回每个重复行的相同数量的副本。

【讨论】:

  • 谢谢你的回答,我明白了:只选择我感兴趣的列然后得到差异。但是如果输入查询是这样的:SELECT ENAME name, JOB FROM emp WHERE DEPTNO=20;如果输入有别名?我如何概括这一点?
  • 列从根本上通过它们的名称/别名来标识。如果输入查询为列分配了意外的别名,则可以说是错误。尽管如此,仍然可能需要根据列顺序检查对应关系,但如果是这样,那么我认为您需要编写存储过程或自定义函数来访问它。恐怕我没有具体的实现方案。
猜你喜欢
  • 1970-01-01
  • 2022-12-04
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2019-10-25
  • 1970-01-01
相关资源
最近更新 更多