【问题标题】:Python Matrix Output to ExcelPython 矩阵输出到 Excel
【发布时间】:2018-05-11 08:31:00
【问题描述】:

我正在尝试输出一个包含 4 行(第一行是标题)和超过 6000 列的矩阵。每个列标题都是来自不同文本文档(第 1-3 行)的一个单词。我想将它导出到 excel,以便我可以轻松过滤频率最高的前 10 个单词。我没有收到任何错误,但 excel 文件中没有显示任何内容。我哪里错了?

np.savetxt('file.csv', matrix_TF, delimiter = ',', newline = '\n', encoding='utf8')

【问题讨论】:

  • 文件写好了吗?
  • " 我想将它导出到 excel 中,这样我就可以轻松过滤出频率最高的前 10 个单词。" 你也可以使用 Python 轻松做到这一点...
  • 你试过像“/tmp/file.csv”这样的绝对路径吗?
  • @PauloScardine 会有帮助吗?
  • 是的,我不知道如何在 python 中做到这一点,所以我认为将其导出到 excel 会更快?

标签: python excel python-3.x csv numpy


【解决方案1】:

我从您对另一个建议的回复中看到您更喜欢在 Python 中执行此操作。这是很有可能的。查看 collections 方法linkd here.

第一节 8.3.1 展示了在 Hamlet

中发现的最常见单词的示例
from collections import Counter

cnt = Counter()

l1 = [['a','b','c','d','e','e','e'],['a','a','a','b','c','d','e'],['a','b','c','c','c','d','e']]

x = 0
for n in l1:
    x += 1
    for tf in n:
        cnt[tf] += 1
    print cnt
    cnt = Counter()

【讨论】:

  • 从原文中获取前 10 个单词没有问题。我关心的是这个术语频率矩阵(matrix_TF)。我需要在 excel 中查看这个矩阵,因为它包含 3 行(所有不同的文本文档)。
  • 您有三个文本文档。我从您的问题中猜测您已经创建了一个词频矩阵,它是标题信息、document1、document2 和 document3 的列表。您仍然可以尝试使用集合。在我的答案中查看更新的代码 sn-p。
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2017-03-24
  • 1970-01-01
相关资源
最近更新 更多