在使用帝国CMS进行内容采集时,分页规则的编写往往是新手最为头疼的部分。虽然帝国CMS的采集功能无法与火车头采集器等专业软件相比,但其功能已经足够满足大多数网站的需求。本文将详细介绍如何编写帝国CMS的采集分页规则,帮助您更高效地完成采集任务。
第一种:
以下是一个常见的分页代码示例:
编写的规则如下: [!--smallpageallzz--]'>下一页
选择“全部列出式”:
区域正则:
链接正则:
第二种:
采集代码如下:
编写的规则: 过滤广告正则: [!--ad--] 例如:http://www.3edu.net/lw/3/lw_31205.html 编写的规则: 选择“全部列出式”: 通过以上四种分页规则的编写示例,您可以根据目标网站的具体情况灵活调整采集规则。希望这些技巧能够帮助您更好地使用帝国CMS进行数据采集。
选用上下导航式:
分页区域正则:[!--smallpagezz--]下一页
分页链接正则:
新闻正文正则:
src="http://pagead2.googlesyndication.com/pagead/show_ads.js">[!--newstext--]
第三种:
以下是另一种分页代码:
"全部列出"式正则设置:
分页区域正则(无)
分页链接正则:
第四种:
以下是最后一个分页代码示例:
区域正则:
[!--smallpageallzz--]" class="nextprev" title="后一页">
链接正则:
【1】 