【发布时间】:2020-06-13 15:01:24
【问题描述】:
我正在尝试将数组保存在文本文件中,但出现 Unicode 错误
df_duplicate = df[df['is_duplicate'] == 1]
dfp_nonduplicate = df[df['is_duplicate'] == 0]
# Converting 2d array of q1 and q2 and flatten the array: like {{1,2},{3,4}} to {1,2,3,4}
p = np.dstack([df_duplicate["question1"], df_duplicate["question2"]]).flatten()
n = np.dstack([dfp_nonduplicate["question1"], dfp_nonduplicate["question2"]]).flatten()
print ("Number of data points in class 1 (duplicate pairs) :",len(p))
print ("Number of data points in class 0 (non duplicate pairs) :",len(n))
#Saving the np array into a text file
np.savetxt('train_p.txt', p, delimiter=' ', fmt='%s')
np.savetxt('train_n.txt', n, delimiter=' ', fmt='%s')`
我知道我需要将其更改为 utf-8 格式,但我无法理解如何处理此特定代码。 还是python的初学者
【问题讨论】:
-
savetxt有encoding参数吗? -
不,我不这么认为
-
你为什么这么认为?你检查过文档吗?
-
尝试添加 utf-8 和 unicode 新错误。 " NameError: 名称 'Unicode' 未定义
-
尝试了一切还是同样的错误,我所做的一切都无法解决这个问题,请帮忙。
标签: python arrays pandas numpy