【发布时间】:2020-09-29 14:37:45
【问题描述】:
我的问题:
我正在与 Athena 合作,我们利用 NetSuite 中的数据创建了许多表。这些表位于名为 AWSDataCatalog 的数据源和名为 dev_netsuite_jdbc_cleaned 的数据库下。
我试过这个命令:SELECT * FROM INFORMATION_SCHEMA.COLUMNS
但是我收到了这个错误:
HIVE_INVALID_METADATA:表的 Hive 元数据 dump_delta_tagpeople_companies_parquet 无效:表描述符 包含重复的列
此查询针对“dev_netsuite_jdbc_cleaned”数据库运行, 除非被查询限定。
基本上,我需要这些信息来查找我们存储信息的位置,以便在 QuickSite 上重新创建我们从 Netsuite 中的某些搜索获得的相同结果,因此我需要首先跟踪所有值的位置...
我想要类似的东西:
表格列类型 1个blabla字符串 1 个城市字符串 2 名称值 2等 3等 4等
有人可以帮我吗?太棒了!
【问题讨论】:
-
这是 hdfs 吗?你在用什么?蜂巢/黑斑羚?如果是hdfs,在oracle中没有
all_tables,INFORMATION_SCHEMA.COLUMNSsql server。如果你需要它,你需要使用 python 或一些脚本来创建它。
标签: sql database amazon-web-services amazon-s3 amazon-athena