【发布时间】:2018-03-13 00:53:49
【问题描述】:
假设我有以下数据:
表 1(我的主数据集):
clear
input str1 Name str9 (Day Time)
A 24-Mar-08 "10:30:01"
A 24-Mar-08 "10:30:01"
B 24-Mar-08 "10:30:01"
B 24-Mar-08 "11:03:12"
B 24-Mar-08 "11:03:12"
C 25-Mar-08 "10:30:01"
D 25-Mar-08 "10:30:01"
D 25-Mar-08 "11:13:59"
E 25-Mar-08 "11:13:59"
F 25-Mar-08 "11:13:59"
F 25-Mar-08 "11:13:59"
F 25-Mar-08 "11:59:01"
end
表 2:
clear
input str1 Insrument str9 (Day Time) float price
A 30-Mar-10 "09:29:34" 10
E 03-Mar-09 "08:23:19" 14
E 20-Mar-12 "12:15:11" 29
F 01-Mar-11 "10:30:01" 12
end
我想从表 1 中删除基于 name 变量的重复观察。我在 Stata 中打开表 1,需要将表 2 引入 Stata,然后从表中删除两个表中具有相同名称的相同观察1.
最后,结果是:
+------+------------+----------+
| name | date | time |
+------+------------+----------+
| B | 24-Mar-08 | 10:30:01 |
| B | 24-Mar-08 | 11:03:12 |
| B | 24-Mar-08 | 11:03:12 |
| C | 25-Mar-08 | 10:30:01 |
| D | 25-Mar-08 | 10:30:01 |
| D | 25-Mar-08 | 11:13:59 |
+------+------------+----------+
SAS中的SQL代码是:
proc SQL;
create table table3 as
select * from table1
where name not in (select Instrument from table2);
quit;
我如何通过 Stata 使用这个程序?
【问题讨论】:
标签: stata