【问题标题】:Creating and using multiple datasets in SPSS在 SPSS 中创建和使用多个数据集
【发布时间】:2021-06-21 15:14:53
【问题描述】:

请原谅这个可能很幼稚的问题,但尽管我有数据库方面的经验,但我是 SPSS 新手,可能忽略了一些简单的事情。

我有关于患者的数据(唯一点标识符、年龄、性别等)

患者接受多种不同类型的测试,每种测试可能需要几百到几千个字段(unique-pt-identifier、testtype、testdate、testdata1、testdata2、... testdata2000)。我有这些测试结果的大量数据集。

我想计算有关测试结果的内容,但这些计算有时需要参考患者的属性。我知道我可以向测试数据集添加列,将患者数据添加到每一行,但这似乎很尴尬和多余(患者多次接受相同类型的测试,所以我最终会多次添加相同的信息)。

这在概念上似乎很简单,但除非我只是使用了错误的术语,否则我在 SPSS 命令语法或多个 Web 搜索中都找不到任何关于此的内容。如果有人指出,很高兴阅读正确的文档。

非常感谢。

【问题讨论】:

    标签: dataset spss


    【解决方案1】:

    在 SPSS 中,您需要将要交互的所有数据放在同一个数据集中。所以是的 - 您必须在同一个 sataset 中获取患者的属性和测试结果。如果这会导致(太大)数据集,那么有两种简单的方法可以使用较小的数据集获得所需的内容: 首先,您不必将所有测试结果和所有患者属性汇总在一起 - 只需将每个分析的相关属性汇总在一起即可。例如:

    match files /file=testresults /table=patients /by=patientID 
        /keep=patientID test1 test2 property1 property2.
    exe.
    dataset name dataForAnalysis1.
    

    第二种方法是首先将测试数据聚合到患者级别,然后才匹配数据集。

    dataset activete testdata.
    dataset declare agg1.
    aggregate out=agg1 /break patientID /test1 test2=mean(test1 test2).
    match files /file=agg1 /table=patients /by patientID.
    exe.
    dataset name dataForAnalysis1.
    

    【讨论】:

    • 感谢您的回复。只是为了确保我明白,您似乎是在说 SPSS只允许一个单一的平面表作为任何统计计算的焦点,是吗?谢谢,
    • 是的。我不知道有什么方法可以在关系模型或类似的东西上运行计算或分析。
    猜你喜欢
    • 2020-01-18
    • 1970-01-01
    • 1970-01-01
    • 2017-05-09
    • 2010-12-22
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多