【问题标题】:Query all tables to retrieve all columns names and data type查询所有表以检索所有列名和数据类型
【发布时间】:2020-09-29 14:37:45
【问题描述】:

我的问题:

我正在与 Athena 合作,我们利用 NetSuite 中的数据创建了许多表。这些表位于名为 AWSDataCatalog 的数据源和名为 dev_netsuite_jdbc_cleaned 的数据库下。

我试过这个命令:SELECT * FROM INFORMATION_SCHEMA.COLUMNS 但是我收到了这个错误:

HIVE_INVALID_METADATA:表的 Hive 元数据 dump_delta_tagpeople_companies_parquet 无效:表描述符 包含重复的列

此查询针对“dev_netsuite_jdbc_cleaned”数据库运行, 除非被查询限定。

基本上,我需要这些信息来查找我们存储信息的位置,以便在 QuickSite 上重新创建我们从 Netsuite 中的某些搜索获得的相同结果,因此我需要首先跟踪所有值的位置...

我想要类似的东西:

表格列类型 1个blabla字符串 1 个城市字符串 2 名称值 2等 3等 4等

有人可以帮我吗?太棒了!

【问题讨论】:

  • 这是 hdfs 吗?你在用什么?蜂巢/黑斑羚?如果是hdfs,在oracle中没有all_tablesINFORMATION_SCHEMA.COLUMNSsql server。如果你需要它,你需要使用 python 或一些脚本来创建它。

标签: sql database amazon-web-services amazon-s3 amazon-athena


【解决方案1】:

错误信息中清楚地说明了问题:“table dump_delta_tagpeople_companies_parquet is invalid: Table descriptor contains duplicate columns”

您有一个名为“dump_delta_tagpeople_companies_parquet”的表,其中包含重复的列。重新创建没有重复列的表,事情就会解决。

【讨论】:

    猜你喜欢
    • 2018-10-11
    • 1970-01-01
    • 1970-01-01
    • 2013-10-17
    • 1970-01-01
    • 1970-01-01
    • 2012-04-27
    • 1970-01-01
    • 2013-12-22
    相关资源
    最近更新 更多