【发布时间】:2018-05-14 06:23:47
【问题描述】:
我有两个文档 A 和 B。为了便于说明,让我们简单说明一下:每个文档都只有一页。页面包含文本和数字形式的信息。
我的目标是标记文档 A 中所有出现在文档 B 中完全的数字。但是考虑数字的上下文也非常重要! 示例:
- “A”包含以下句子:“我 2017 年的薪水是 50 000 欧元”
- “B”包含以下句子:“我 2016 年的工资是 50 000 欧元”和“我 2017 年的工资是 50 000 欧元”
由于B中的第二句,此处计算机应在A中标记“50 000”。如果只有B的第一句,则不应标记数字。
我的问题是:这是卷积神经网络 (CNN) 或支持向量机 (SVM) 等机器学习技术的用途吗?也许我可以通过解析或字符串识别(或类似的东西)来解决这个问题,但我相信机器学习方法会提供更准确的结果!
也许还有一些其他技术更适合我的目标。
感谢您的帮助!
【问题讨论】:
标签: machine-learning neural-network artificial-intelligence svm pattern-recognition