【发布时间】:2018-03-24 20:04:55
【问题描述】:
我需要按如下方式找到每列中的字母数:
String: ATCG
TGCA
AAGC
GCAT
字符串是一个系列。
我需要编写一个程序来获取以下内容:
0 1 2 3
A 2 1 1 1
T 1 1 0 1
C 0 1 2 1
G 1 1 1 1
我已经编写了以下代码,但我在 0 索引和最后的列(列索引 450,实际列号 451)中得到了一个 nan 值的行。我不应该得到第 451 行或第 451 列。我只需要 450 列。
f = zip(*string)
counts = [{letter: column.count(letter) for letter in column} for column in
f]
counts=pd.DataFrame(counts).transpose()
print(counts)
counts = counts.drop(counts.columns[[450]], axis =1)
谁能帮我理解这个问题?
【问题讨论】:
标签: python pandas bioinformatics biopython