【问题标题】:Best practice for writing SQL queries in Jupyter在 Jupyter 中编写 SQL 查询的最佳实践
【发布时间】:2019-05-09 18:01:46
【问题描述】:

我正在使用 Jupyter 笔记本进行一些分析。我通常使用pandas.read_sql() 在 Jupyter 中编写 SQL 查询。最近我写了一个比较大的带有多个连接的查询。它大约有 25 行查询。在 Jupyter 中编写此类查询时,最佳实践是什么?例如,编写这样的查询没什么大不了的 -

pd.read_sql('select cs1.CLIENT as ClientName from central cs1', db.connect_win())

它很容易阅读和理解,但是更大的查询呢?我希望它们有缩进等,这样它们更容易阅读和理解。

【问题讨论】:

    标签: pandas jupyter-notebook


    【解决方案1】:

    我会做这样的事情。

    sql_query = """
      SELECT first_name, last_name
      FROM actor
      WHERE actor_id IN
      (
        SELECT actor_id
        FROM film_actor
        WHERE film_id IN
        (
          SELECT film_id
          FROM film
          WHERE title = 'ALTER VICTORY'
        )
      );
    """
    actor = pd.read_sql(sql_query, db.connect_win())
    

    有一些很棒的 VS 代码扩展,例如 SQL Server (mssql)。它将为您自动格式化。有时我喜欢先使用 VS Code 作为 linting 工具,然后将生成的查询粘贴回我的 Jupyter notebook。

    【讨论】:

    • 这是一个很好的建议。像这样编写查询将迫使您将较大的查询分解为较小的查询。好建议!
    猜你喜欢
    • 2014-01-18
    • 2013-01-06
    • 1970-01-01
    • 2012-09-26
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2013-05-10
    相关资源
    最近更新 更多