【发布时间】:2016-12-03 07:42:25
【问题描述】:
需要分析的csv在第一行包含一个无用的标签。
标题位于第二行。
第 102 行及以后的其他无用信息,总计 147 行无用信息,其中包含的列数与其上方的 100 行不同。
相关行包含数值以及偶尔的NaN。
当csv 打开时,它会类似于:
unnecessarily labeled
columnA columnB columnC columnD columnE
1 2 3 4 5
4 5 6 NaN 8
[...]
301 302 303 304 305
data that really belongs in a separate csv
csv sample
unnecessarily labeled,,,,,,,,
columnA,columnB,columnC,columnD,columnE,,,,
1,2,3,4,5,,,,
4,5,6,NaN,8,,,,
301,302,303,304,305,,,,
data,that,really,belongs,in,a,separate,csv,
如果我要在 bash 中预处理文件,我会:
sed -e1,1d $f > $processedFilename #remove the top line
head -n -147 $processedFilename > tmp && mv tmp $processedFilename #remove the last 147 lines
我可以在 Matlab 中进行类似的预处理吗?这可以用readtable 更直接地完成吗?换句话说,我怎样才能将这个csv 数据加载到一个表中,最好是利用自动填充标题并且只有相关的行和列的好处?也就是说,有没有平行的to
T = readtable('patients.xls',...
'Range','C2:E6',...
对于csv 数据?
【问题讨论】: