自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

王小优
王小优
王小优
231
文章
0
评论
2015年6月6日 评论 5,861 1106字阅读3分41秒

WordPress是一种使用PHP语言开发的建站程序平台,现在做博客用WordPress的已经很多了,很多网站制作培训都使用的是WordPress,特别是在做采集站的时候WordPress的共能很强大。下面就给大家介绍如何实现WordPress的自动采集功能。

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

安装网站采集插件:WP-AutoPost

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

点击“新建任务”后,输入任务名称,即可创建新任务,创建好新任务之后可以在任务列表中查看到该任务,就可对该任务进行更多设置(这一部分不需要修改设置,唯一需要改动的就是采集的时间)。

文章来源设置:在该选项卡下我们需要设置文章来源的文章列表网址及具体文章的匹配规则。我们以采集“新浪互联网国际滚动新闻”为例,文章列表网址为http://roll.tech.sina.com.cn/internet_worldlist/index.shtml,因此在手工指定文章列表网址中输入该网址即可,如下所示:

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

文章网址匹配规则:文章网址匹配规则的设置非常简单,无需复杂设置,提供两种匹配模式,可以使用URL通配符匹配,也可以使用CSS选择器进行匹配,通常使用URL通配符匹配较为简单,但有时使用CSS选择器更为精确。

使用URL通配符匹配:通过点击列表网址 http://roll.tech.sina.com.cn/internet_worldlist/index.shtml上的文章,我们可以发现每篇文章的URL都为如下结构:http://tech.sina.com.cn/i/2013-06-27/16328485884.shtml,因此将URL中变化的数字或字母替换为通配符 (*) 即可,如:http://tech.sina.com.cn/i/(*)/(*).shtml 。重复的网址可以使用301重定向。

使用CSS选择器进行匹配:使用CSS选择器进行匹配,我们只需要设置文章网址的CSS选择器即可,通过查看列表网址http://roll.tech.sina.com.cn/internet_worldlist/index.shtml的源代码即可轻松设置,找到列表网址下文章超链接的代码,如下所示:

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

可以看到,文章的超链接a标签在class为“contList”的标签内部,因此文章网址的CSS选择器只需要设置为.contList a即可,如下所示:

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

设置完成之后,不知道设置是否正确,可以点击上图中的测试按钮,如果设置正确,将列出该列表网址下所有文章名称和对应的网页地址,如下所示:

自动采集插件:WP-AutoPost设置图文教程 – WordPress教程

其他的设置可以不用修改。

以上采集方法适用于WordPress多站点功能。

相关链接

中文采集插件:WP-AutoPost (正版/破解版) – WordPress插件

若文章图片、下载链接等信息出错,请在评论区留言反馈,博主将第一时间更新!如果喜欢,请打赏支持本站,谢谢大家!
  • 我的微信
  • 微信扫一扫
  • weinxin
  • 我的微博
  • 微博扫一扫
  • weinxin
王小优
匿名

发表评论

匿名网友 填写信息

:?: :razz: :sad: :evil: :!: :smile: :oops: :grin: :eek: :shock: :???: :cool: :lol: :mad: :twisted: :roll: :wink: :idea: :arrow: :neutral: :cry: :mrgreen: