【发布时间】:2014-06-12 19:44:31
【问题描述】:
我正在尝试从 Wiki 页面中提取文本,存储其格式,然后将其全部转换为 PDF。
我知道 ITextSharp 库可以帮助我将其放入 PDF 中,但我将如何在保持格式的同时将文本从网站上提取出来?
【问题讨论】:
-
这听起来不像是一个让自己的脚湿透的小项目。但也许你是个天才?
-
至少有 3 个问题 - 如何从网站读取文本(也就是如何使用
WebClient)、如何解析 HTML(也就是给我 HtmlAgility 包操作方法)以及从 HTML 创建 PDF .请务必研究之前已经问过的问题,并分别询问每个新问题。 -
旁注:无需在您的帖子中添加“谢谢”、“这里是新的/使用 C#”。无论如何,在大多数情况下,知识/关心的水平从问题中是非常明显的。
标签: c# pdf pdf-generation