【发布时间】:2021-05-24 06:10:05
【问题描述】:
我有两个巨大的数据框,df1 有(8831 行 x 918 列),df2 有(8831 行 x 944 列)。我正在尝试水平合并它们并避免创建“重复”。许多列的标题相同,内容也相同,不同之处在于存储。我的 df1 cols 存储为 int8 ,这是我想要保留的。
总而言之,我想水平合并df1和df2,如果col是df1和df2的相同标题,那么我想只取df1。
【问题讨论】:
-
请通过intro tour、help center 和how to ask a good question 了解本网站的运作方式并帮助您改进当前和未来的问题,从而帮助您获得更好的答案。 “告诉我如何解决这个编码问题?”与 Stack Overflow 无关。您必须诚实地尝试解决方案,然后就您的实施提出具体问题。 Stack Overflow 无意取代现有的教程和文档。
-
我建议您按照从教程和示例中学到的内容分阶段进行。如果遇到困难,请提供预期的MRE - Minimal, Reproducible Example。显示中间结果与预期结果的偏差。我们应该能够将您的代码块粘贴到文件中,运行它并重现您的问题。这也让我们可以在您的上下文中测试任何建议。
-
请添加一些您尝试解决此问题的代码,否则请寻找关于 Pandas 的好的教程并尝试一些代码。
标签: python pandas merge duplicates concatenation