动态 SQL 和 RETURN 类型
(我把最好的留到最后,继续阅读!)
您要执行动态 SQL。原则上,在EXECUTE 的帮助下,这在plpgsql 中很简单。您不需要 光标。事实上,大多数情况下,没有显式游标会更好。
您遇到的问题:您想要返回尚未定义类型的记录。函数需要在RETURNS 子句中声明其返回类型(或使用OUT 或INOUT 参数)。在您的情况下,您将不得不回退到匿名记录,因为返回的列的 number、names 和 types 各不相同。喜欢:
CREATE FUNCTION data_of(integer)
RETURNS SETOF record AS ...
但是,这并不是特别有用。您必须在每次调用时提供列定义列表。喜欢:
SELECT * FROM data_of(17)
AS foo (colum_name1 integer
, colum_name2 text
, colum_name3 real);
但是,如果您事先不知道列,您会怎么做呢?
您可以使用结构较少的文档数据类型,例如 json、jsonb、hstore 或 xml。见:
但是,就这个问题而言,我们假设您希望尽可能多地返回单独、正确键入和命名的列。
具有固定返回类型的简单解决方案
datahora 列似乎是给定的,我假设数据类型为timestamp,并且总是有另外两列具有不同的名称和数据类型。
名称我们将放弃返回类型中的通用名称。
类型我们也将放弃,并将所有内容转换为 text因为每个数据类型都可以转换为text。
CREATE OR REPLACE FUNCTION data_of(_id integer)
RETURNS TABLE (datahora timestamp, col2 text, col3 text)
LANGUAGE plpgsql AS
$func$
DECLARE
_sensors text := 'col1::text, col2::text'; -- cast each col to text
_type text := 'foo';
BEGIN
RETURN QUERY EXECUTE '
SELECT datahora, ' || _sensors || '
FROM ' || quote_ident(_type) || '
WHERE id = $1
ORDER BY datahora'
USING _id;
END
$func$;
变量_sensors和_type可以改为输入参数。
注意RETURNS TABLE 子句。
注意RETURN QUERY EXECUTE 的使用。这是从动态查询中返回行的更优雅的方法之一。
我为函数参数命名,只是为了让RETURN QUERY EXECUTE 的USING 子句不那么混乱。 SQL 字符串中的$1 不是指函数参数,而是指使用USING 子句传递的值。 (在这个简单的示例中,两者恰好在各自的范围内都是 $1。)
注意_sensors 的示例值:每一列都转换为text 类型。
这种代码很容易受到SQL injection 的攻击。我使用quote_ident() 来防范它。将变量_sensors 中的几个列名集中在一起可以防止使用quote_ident()(这通常是个坏主意!)。确保没有坏东西可以通过其他方式出现,例如通过 quote_ident() 单独运行列名。想到一个VARIADIC 参数...
自 PostgreSQL 9.1 起更简单
对于 9.1 或更高版本,您可以使用format() 进一步简化:
RETURN QUERY EXECUTE format('
SELECT datahora, %s -- identifier passed as unescaped string
FROM %I -- assuming the name is provided by user
WHERE id = $1
ORDER BY datahora'
,_sensors, _type)
USING _id;
同样,单个列名可以正确转义,这将是一种干净的方式。
不同数量的列共享相同类型
在您的问题更新后,您的返回类型似乎有
- 可变的列数
- 但所有列的类型
double precision(别名float8)
在这种情况下使用ARRAY 类型来嵌套可变数量的值。此外,我返回一个列名数组:
CREATE OR REPLACE FUNCTION data_of(_id integer)
RETURNS TABLE (datahora timestamp, names text[], values float8[])
LANGUAGE plpgsql AS
$func$
DECLARE
_sensors text := 'col1, col2, col3'; -- plain list of column names
_type text := 'foo';
BEGIN
RETURN QUERY EXECUTE format('
SELECT datahora
, string_to_array($1) -- AS names
, ARRAY[%s] -- AS values
FROM %s
WHERE id = $2
ORDER BY datahora'
, _sensors, _type)
USING _sensors, _id;
END
$func$;
各种完整的表格类型
要真正返回表格的所有列,有一个使用polymorphic type 的简单而强大的解决方案:
CREATE OR REPLACE FUNCTION data_of(_tbl_type anyelement, _id int)
RETURNS SETOF anyelement
LANGUAGE plpgsql AS
$func$
BEGIN
RETURN QUERY EXECUTE format('
SELECT *
FROM %s -- pg_typeof returns regtype, quoted automatically
WHERE id = $1
ORDER BY datahora'
, pg_typeof(_tbl_type))
USING _id;
END
$func$;
打电话(重要!):
SELECT * FROM data_of(NULL::pcdmet, 17);
将调用中的pcdmet 替换为任何其他表名。
这是如何工作的?
anyelement 是伪数据类型,多态类型,任何非数组数据类型的占位符。函数中所有出现的anyelement 都会评估为运行时提供的相同类型。通过将定义类型的值作为参数提供给函数,我们隐式定义了返回类型。
PostgreSQL 自动为每个创建的表定义一个行类型(一种复合数据类型),因此每个表都有一个定义良好的类型。这包括临时表,方便临时使用。
任何类型都可以是NULL。提交NULL 值,转换为表格类型:NULL::pcdmet。
现在该函数返回一个定义明确的行类型,我们可以使用SELECT * FROM data_of() 来分解行并获取各个列。
pg_typeof(_tbl_type) 将表的名称返回为object identifier type regtype。当自动转换为text 时,如果需要,标识符会自动双引号和模式限定,从而自动防御 SQL 注入。这甚至可以处理quote_ident() 会失败的模式限定表名。见: