【问题标题】:Is it possible to pull information out a link from an article form for example the verge [closed]是否可以从文章表单中提取信息链接,例如边缘 [关闭]
【发布时间】:2012-09-01 21:29:28
【问题描述】:

我正在尝试制作一些东西,您可以在其中放入文章的链接,然后将文章的标题,描述,...而且我认为它只与RSS阅读器可以阅读的网站兼容。有人可以帮我或给我一点帮助,例如如何用简单的馅饼来做。

【问题讨论】:

  • 这篇文章是在你的服务器上还是别人的?
  • 这是一个非常宽泛的问题。您是否遇到了一些特定的步骤?
  • cURL 数据并使用 DOMDocument 解析它。这是你的信息:)
  • 请更准确地说,存储的内容。这种问题真的没法回答。
  • 文章来自博客。它实际上与 safari 中的阅读器功能相同。您可以在网络应用程序中复制 url,网络应用程序将显示它干净。就像 safari 上的阅读器功能一样。

标签: php xml rss xml-parsing simplepie


【解决方案1】:

这就是 RSS 存在的原因 - 一种以标准化方式读取信息的方法。
在 html5 之前的时代,每个 Web 开发人员或多或少都在发明自己的格式,因为 xhtml、html4 没有合适的语义元素。

几个例子:

<div class="article">
   <h1>Article</h1>
   <p>Content Content Content Content Content</p>
</div>

<div class="article">
   <span class="arcticleHeader">Article</span>
   <div class="left">Content Content Content Content Content</div>
</div>

与 html5 不同。 还有更多的语义元素,例如&lt;article&gt;&lt;header&gt;&lt;footer&gt;

但您仍然无法知道内容的实际结构。

您应该为此使用明确定义的格式,例如 RSSATOMRDF
Wikipedia describes this problem very well

标准化的 XML 文件格式允许信息被发布一次并被许多不同的程序查看。

【讨论】:

  • 谢谢,但是如何从包含
    标签的文章中获取内容的 url。必须有一些 javascript 或 php 代码需要。我不能从任何地方举个例子。我认为像 digg 这样的服务使用这个。
猜你喜欢
  • 2011-07-25
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2012-11-11
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多