【问题标题】:Count cases using segmentation variable in SPSS在 SPSS 中使用分段变量计算案例
【发布时间】:2015-11-03 00:23:50
【问题描述】:

我有一个包含 5,000 多个案例的 SPSS 数据集,如下所示:

ID, relation to head of household
1, head of household
1, son
1, partner
2, head of household
2, son
3, head of household
3, son
3, cousin

我需要统计拥有的家庭数量

  1. 户主+孩子
  2. 户主+伴侣+孩子
  3. 户主+亲戚
  4. 户主 + 伴侣 + 亲戚。

我知道这应该使用 ID 作为分段变量来完成,但不知道如何。

【问题讨论】:

    标签: statistics spss


    【解决方案1】:

    一种方法是为每个类别制作一组虚拟变量,然后使用 AGGREGATE 获取家庭级别的统计数据。

    DATA LIST LIST (",") /ID (F1.0) Relation (A20).
    BEGIN DATA
    1,head of household
    1,son
    1,partner
    2,head of household
    2,son
    3,head of household
    3,son
    3,cousin
    END DATA.
    DATASET NAME Houses.
    
    *Making dummy variables.
    COMPUTE HeadHouse = (Relation = "head of household").
    COMPUTE Partner = (Relation = "partner").
    COMPUTE Child = (Relation = "son").
    COMPUTE Relative = (Relation = "cousin").
    
    DATASET DECLARE AggHouse.
    AGGREGATE OUTFILE='AggHouse'
      /BREAK ID
      /HeadHouse = SUM(HeadHouse)
      /Partner = SUM(Partner)
      /Child = SUM(Child)
      /Relative = SUM(Relative).
    

    然后使用聚合数据集,您可以随后使用 IF 语句来计算您想要的条件。例如

    DATASET ACTIVATE AggHouse.
    IF (HeadHouse > 0) AND (Child > 0) First = 1.
    IF (HeadHouse > 0) AND (Partner > 0) AND (Child > 0) Second = 1.
    

    对于您的真实数据集,您需要为原始虚拟变量集插入更多条件,但我将其作为练习留给您。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-02-22
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多