【发布时间】:2020-01-03 18:03:37
【问题描述】:
刚开始接触RDF和本体,主要是把非结构化文本转成RDF(可能是手动),发现很多简单句子转RDF三元组的例子123,但复杂的不多句子(使用形容词或副词)4。
复合句示例:那些喜欢巧克力冰淇淋的孩子和那些喜欢香草冰淇淋的孩子,哪个更好?
别管句子的意思,值得注意的是冰淇淋(巧克力、香草)和喜欢(愉快)的形容词的使用,以及两种类型的孩子(谁更好)和一个问题。我们如何将这样的句子表示为 SPO 三元组 (RDF) 语句的集合——以便它可以处理形容词、副词或比较或其他操作?
S1:儿童 - 喜欢 - (冰淇淋、风味、巧克力)
S2:儿童 - 喜欢 - (冰淇淋、风味、香草)
S3:愉快地喜欢
S4:更好(S1+S3,S2+S3)
有没有一种通用的方法来翻译这些语句?应该在哪里寻找这个方向的一些探索 - 将非结构化文本转换为 n 元组?也许我没有问正确的问题 - 在这种情况下,请告诉我。谢谢!
【问题讨论】:
-
新提案是RDF*。您可以看到与传统方法(具体化和单例属性)相比有哪些好处。
-
那是研究课题,没有解决方案,也没有通用的方法。 “从文本中提取本体”或“从非结构化数据中提取”是要搜索的关键词。我们朝这个方向做了很多事情,现在将使用不同的神经网络方法并产生影响。
标签: rdf semantic-web triples reification