【发布时间】:2016-11-25 08:04:46
【问题描述】:
我需要解析以下字符串(解析PDF,想避开第三方包)。
/Type /Pages /MediaBox [0 0 612 792] /Count 9 /Kids [5 0 R 355 0 R]
我正在使用 Javascript:
String.split(' ');
我想得到的输出是 [ '/类型', '/页', '/媒体框', '[0 0 612 792]', '/数数', '9', '/孩子们','[5 0 R 355 0 R]' ]
这将导致:以下输出:['
具体来说,我想分隔“[”和“]”。这样字符串将显示为 '[ 5, 0, R, 355, 0, R]'
预期的最终结果是这样的:
我正在尝试查看是否可以使用正则表达式解决此问题,但目前我被卡住了。
【问题讨论】:
-
您知道示例中的大部分空格都是可选的吗?这些键值对也可以写成
/Type/Pages/MediaBox[0 0 612 792]/Count 9/Kids[5 0 R 355 0 R]。您的解析想法太简单了...此外,中间还可以有注释行...
标签: javascript parsing pdf