【发布时间】:2014-08-04 15:16:18
【问题描述】:
一个新的问题/最终产品的一部分浮出水面
我的输入文件如下所示:
NAME; YEAR; ID; VALUE
Sample1; 1998; 354; 45
Sample1; 1999; 354; 23
Sample1; 2000; 354; 66
Sample1; 2001; 354; 98
Sample1; 2002; 354; 36
Sample1; 2003; 354; 59
Sample1; 2004; 354; 64
Sample1; 2005; 354; 23
Sample1; 2006; 354; 69
Sample1; 2007; 354; 94
Sample1; 2008; 354; 24
Sample2; 1964; 1342; 7
Sample2; 1965; 1342; 24
Sample3; 2002; 859; 90
Sample3; 2003; 859; 93
Sample3; 2004; 859; 53
Sample3; 2005; 859; 98
我想做的是在每个样本组的顶部添加一行(例如,样本 1 的上一行,样本 2 的上一行等),其中包含来自初始行的所有相同值,除了对于 VALUE 字段,它应该包含值 0,对于 YEAR 字段,它应该是上一年。
我的最终输出大约 80000 个样本应该是这样的:
NAME; YEAR; ID; VALUE
Sample1; 1997; 354; 0
Sample1; 1998; 354; 45
Sample1; 1999; 354; 23
Sample1; 2000; 354; 66
Sample1; 2001; 354; 98
Sample1; 2002; 354; 36
Sample1; 2003; 354; 59
Sample1; 2004; 354; 64
Sample1; 2005; 354; 23
Sample1; 2006; 354; 69
Sample1; 2007; 354; 94
Sample1; 2008; 354; 24
Sample2; 1963; 354; 0
Sample2; 1964; 1342; 7
Sample2; 1965; 1342; 24
Sample3; 2001; 1342; 0
Sample3; 2002; 859; 90
Sample3; 2003; 859; 93
Sample3; 2004; 859; 53
Sample3; 2005; 859; 98
感谢您的帮助!
【问题讨论】: