【发布时间】:2014-08-28 21:28:45
【问题描述】:
假设我想将 Amontillado 中的一段文字复制到 Python 中,然后逐个字符('t'、'h'、'e' 等)将其分解。如果我以“正确”格式复制段落,它将包含特殊字符,如 \t 和 \n。
在我的一生中,我无法让这些特殊字符延续到 Python 中。我已经尝试了好几次,但不是识别字符,而是识别空格而不是别的。我不知道我是不是太含糊了,但是当我将大块文本复制到 Python 中并将它们分解时,我试图保留它们的格式,但我做不到。有什么我应该寻找的阅读材料,还是我只是太密集而遗漏了什么?
例如,使用 python 的 Wikipedia 库,如果我搜索红环熊猫:
results = wikipedia.search('Ringed Panda', targets)
print results.content
我得到一块没有任何格式的文本(“段落”及其所有格式(即换行符/换行符)似乎被一系列单行文本替换。
如果我将任何一组格式化文本(又是 The Cask of Amontillado)复制到 Spyder 甚至 IDLE 中,则格式不会保留。
我只是看错了,还是我错过了什么?
【问题讨论】:
-
如何“复制”文本?你的意思是复制和粘贴?原始格式是什么? PDF?你在哪里粘贴? IDE?
-
现在只是复制和粘贴,我不知道通过任何其他方式这样做会改变格式的延续方式......
-
尝试创建最简单、最短的程序来演示问题。将该简短程序复制粘贴到您的问题中。
-
目前文本是什么格式/文件?