【发布时间】:2018-04-24 18:57:32
【问题描述】:
我每天都会收到一个平面文件 (CSV),其中的内容会导入我的数据库(而不是通过网络表单、POS 等进行数据输入)。一条记录中有 40 个字段,我最多有 600,000 条唯一记录。
到目前为止,我还没有看到有必要将它变成一个关系数据库,尽管肯定有一些规范化可以提高它的效率;重复产品、商店、客户、经销商等。
如果我从头开始并以某种方式逐步输入数据,我会知道如何做所有这些(我经历过的每一个资源都以这种方式涵盖它,但当你有大量的数据已经并且需要使其相关)。并且随着 CVS 的到来,我不太确定一旦数据库建立起来如何导入数据。如果我要将这 40 个字段拆分为 5 个表,那么我是否必须以相同的方式拆分该每日文件并一次导入一个?外键会以这种方式更新吗?
如果有人能把我推向正确的方向,我会自己去挖掘更多的东西。
如果你面对同一个项目,你会如何创建这样一个数据库并执行每日更新?
谢谢!
【问题讨论】:
标签: mysql csv relational-database normalization