据我解读你的问题,它由两部分组成:
(1)你需要实现upsert逻辑(get-or-create逻辑)。
(2) 您的get 部分需要查询的不是单个表,而是按特定顺序查询的一对表。表名暗示这是您的应用程序内部的某种别名引擎。
让我们从 (2) 开始。这绝对可以通过两个查询来解决,就像你感觉到的一样。
function pick_name (rows)
{
if (! rows.length) return null
return rows[0].name
}
// you can sequence queries
function ingredient_get (name)
{
return knex('ingredients')
.select('id').where('name', name)
.then(pick_name)
.then(name =>
{
if (name) return name
return knex('synonyms')
.select('word_id').where('name', name)
.then(pick_name)
})
}
// or run em parallel
function ingredient_get (name)
{
var q_ingredients = knex('ingredients')
.select('id').where('name', name)
.then(pick_name)
var q_synonyms = knex('synonyms')
.select('word_id').where('name', name)
.then(pick_name)
return Promise.all([ q_ingredients, q_synonyms ])
.then(([name1, name2]) =>
{
return name1 || name2
})
}
这里的重要概念:
- 两种形式都运行良好,并返回第一次出现或 JS'
null。
- 第一种形式优化了对 DB 的查询计数。
- 第二种形式优化了回答时间。
但是,您可以更深入地使用更多 SQL。有一个用于此类任务的特殊工具,称为COALESCE。您可以查阅您的 SQL 文档,这里是 COLASCE of PostgreSQL 9。 COALESCE 的主要思想是返回第一个非 NULL 参数,否则返回 NULL。因此,您可以利用它来优化查询和回答时间。
function ingredient_get (name)
{
// preparing but not executing both queries
var q_ingredients = knex('ingredients')
.select('id').where('name', name)
var q_synonyms = knex('synonyms')
.select('word_id').where('name', name)
// put them in COALESCE
return knex.raw('SELECT COALESCE(?, ?) AS name', [ q_ingredients, q_synonyms ])
.then(pick_name)
这个解决方案保证了单一查询,而且数据库引擎可以以它认为合适的任何方式优化执行。
现在让我们解决 (1):我们现在得到了 ingredient_get(name),它返回 Promise<string | null>。我们可以使用它的输出来激活create 逻辑或返回我们的值。
function ingredient_get_or_create (name, data)
{
return ingredient_get(name)
.then(name =>
{
if (name) return name
// …do your insert logic here
return knex('ingredients').insert({ name, ...data })
// guarantee homohenic output across get/create calls:
.then(() => name)
})
}
现在 ingredient_get_or_create 做你想要的 upsert 逻辑。
UPD1:
我们已经得到了ingredient_get_or_create,它在任何情况下(获取或创建)都会返回Promise<name>。
a) 如果您需要在此之后执行任何特定逻辑,您可以使用then:
ingredient_get_or_create(…)
.then(() => knex('another_table').insert(…))
.then(/* another logic after all */)
在 Promise 语言中,这意味着“如果之前没问题,请执行该操作 (then) (ingredient_get_or_create)”。在大多数情况下,这就是您所需要的。
b) 要在 Promise 中实现 for 循环,您有多种不同的习惯用法:
// use some form of parallelism
var qs = [ 'name1', 'name2', 'name3' ]
.map(name =>
{
return ingredient_get_or_create(name, data)
})
var q = Promise.all(qs)
请注意,这是一种激进的并行性,您将获得最大的并行查询,就像您的输入数组提供的那样。
如果不需要,您需要限制并行性,甚至按顺序运行任务。 Bluebird 的Promise.map 是一种运行map 的方法,类似于上面的示例,但有concurrency 选项可用。有关详细信息,请参阅文档。
还有 Bluebird 的 Promise.mapSeries,它在概念上类似于 for 循环,但带有承诺。这就像按顺序运行的地图。查看文档了解详细信息。
Promise.mapSeries([ 'name1', 'name2', 'name3' ],
(name) => ingredient_get_or_create(name, data))
.then(/* logic after all mapSeries are OK */)
我相信最后一个是你需要的。