【问题标题】:Copying Text in Python and Preserving/Finding Special Characters在 Python 中复制文本并保留/查找特殊字符
【发布时间】:2014-08-28 21:28:45
【问题描述】:

假设我想将 Amontillado 中的一段文字复制到 Python 中,然后逐个字符('t'、'h'、'e' 等)将其分解。如果我以“正确”格式复制段落,它将包含特殊字符,如 \t 和 \n。

在我的一生中,我无法让这些特殊字符延续到 Python 中。我已经尝试了好几次,但不是识别字符,而是识别空格而不是别的。我不知道我是不是太含糊了,但是当我将大块文本复制到 Python 中并将它们分解时,我试图保留它们的格式,但我做不到。有什么我应该寻找的阅读材料,还是我只是太密集而遗漏了什么?

例如,使用 python 的 Wikipedia 库,如果我搜索红环熊猫:

results = wikipedia.search('Ringed Panda', targets)
print results.content

我得到一块没有任何格式的文本(“段落”及其所有格式(即换行符/换行符)似乎被一系列单行文本替换。

如果我将任何一组格式化文本(又是 The Cask of Amontillado)复制到 Spyder 甚至 IDLE 中,则格式不会保留。

我只是看错了,还是我错过了什么?

【问题讨论】:

  • 如何“复制”文本?你的意思是复制和粘贴?原始格式是什么? PDF?你在哪里粘贴? IDE?
  • 现在只是复制和粘贴,我不知道通过任何其他方式这样做会改变格式的延续方式......
  • 尝试创建最简单、最短的程序来演示问题。将该简短程序复制粘贴到您的问题中。
  • 目前文本是什么格式/文件?

标签: python text


【解决方案1】:

只需使用三引号并在字符串上运行list()

text = '''
hello world
this    is  tabbed
'''

print list(text)

应该打印出来

['\n', 'h', 'e', 'l', 'l', 'o', ' ', 'w', 'o', 'r', 'l', 'd', '\n', 't', 'h', 'i', 's', '\t', 'i', 's', '\t', 't', 'a', 'b', 'b', 'e', 'd', '\n']

【讨论】:

    猜你喜欢
    • 2011-05-08
    • 1970-01-01
    • 1970-01-01
    • 2018-02-16
    • 2021-01-26
    • 2018-09-29
    • 2019-02-11
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多