php生成百度sitemap站点地图类函数实例


Posted in PHP onOctober 17, 2014

本文实例讲述了php生成百度sitemap站点地图类函数的方法,分享给大家供大家参考。具体实现方法如下:

问题概述:

公司网站是问答百科的网站、seo工程师提出需求说根据网站的问题来生成xml文件。每个xml文件包含5000条setmap格式数据。现在线上网站大约有70w条问题,所以说基本生成140个xml文件。还有一个索引文件。比如文件的名称以数字开头的。索引文件包含的内容就是每个xml文件的路径还有名称。
为什么要每个文件存储5000条数据呢,因为这是mysql的一个界限值、如果每次取多了以后可能会对线上用户访问造成影响,或者速度变慢。每个文件存储5000条数据,但是mysql selsect的时候不能每次取5000条、现在写的是每次取1000条。那这样逻辑就有点复杂。

实现方法:

首先取出1000条数据(可以灵活些成活的,方便以后修改),然后循环生成xml格式文件。file_puts_contens写入文件。然后再把生成的xml文件名称、取出问题的最小id、取出问题的最大id、取出问题的条数写出一个索引查询的txt文件当中,格式大概是这个样子的。
0,3146886,3145887,1000
发现最后面的条数是1000了吗、第一次select取出1000条数据、然后写入0.xml文件当中。把取出的xml文件名称、最小id、最大id、条数写入到索引查询txt中。第一次写入了1000条数据到0.xml、生成条数为1000。第二次查询的时候select语句会成为。 where id > 取出的最大id(当前mysql为正序查询、如果为倒序、改成小于) limit 1000 这样的话又取出1000、然后修改索引查询txt的最小id、最大id、生成条数加到2000。以此类推等生成条数到了5000的时候再另起一行写入索引文件、类似这样
0,3146886,3145887,5000
1,3148886,3147887,1000
这样写的话就减轻了服务器的压力。
下面贴出实现代码(风格有点乱):

具体功能代码如下:

<?php

/*

 * SiteMap接口类

 */

 

class SitemapAction extends Action{

private static $baseURL = ''; //URL地址

private static $askMobileUrl = 'http://m.xxx.cn/ask/'; //问答移动版地址

private static $askPcUrl = "http://www.xxx.cn/ask/";   //问答pc地址

private static $askZonePcUrl = "http://www.xxx.cn/ask/jingxuan/"; //问答精选Pc链接

private static $askZoneMobileUrl = "http://m.xxx.cn/ask/jx/"; //问答精选移动版链接

        //问答setmaps

public function askSetMap(){

header('Content-type:text/html;charset=utf-8');

//获取问题列表

$maxid = 0;    //索引文件最大id

$minid = 0;    //索引文件最小id

$psize = 1000; //数据库每次取数量

$maxXml = 5000; //xml写入记录数量

$where = array();

//读取索引文件

$index = APP_PATH.'setmapxml/Index.txt';

//关联setmaps路径

$askXml = "../siteditu/ask/ask.xml";

if(!file_exists($index)){

$fp=fopen("$index", "w+");

if ( !is_writable($index) ){

die("文件:" .$index. "不可写,请检查!");

}

fclose($fp);

}else{

//index.txt文件说明 0:xml文件名称(从1开始)、1:文件最大id、2:文件最小id、3:文件当前记录数

$fp = file($index);

$string = $fp[count($fp)-1];//显示最后一行

$arr = explode(',', $string);

}

//索引文件数量是否小于$maxXml

//如果为第一次运行

if(!$arr[1]){

$bs=1;

$filename=0;

}else{

if($arr && $arr[3]<$maxXml){

$filename = $arr[0];

$psize = $maxXml-$arr[3]>$psize?$psize:($maxXml-$arr[3]);

$bs = 0;

}else{

$filename = $arr[0]+1;

$bs=1;

}

}

$maxid = empty($arr[1])?0:$arr[1];

$minid = empty($arr[2])?0:$arr[2];

echo "文件名称:".$filename.".xml"."<br/ >";

echo "最大id:".$maxid."<br />";

echo "最小id:".$minid."<br />";

echo "xml写入最大记录:".$maxXml."<br />";

echo "数据库每次读取数量:".$psize."<br />";

$list = self::$questionObj->getQuestionSetMap($where,$maxid,$psize);

if(count($list)<=0){

echo 1;exit;

}

$record = $arr[3]+count($list); //索引文件写入记录数

$indexArr = array('filename'=>$filename,'maxid'=>$maxid,'minid'=>$minid,'maxXml'=>$record);

$start = '<?xml version="1.0" encoding="UTF-8" ?> '.chr(10);

$start.="<urlset xmlns=\"http://www.sitemaps.org/schemas/sitemap/0.9\" xmlns:mobile=\"http://www.baidu.com/schemas/sitemap-mobile/1/\">".chr(10);

                                $start.="</urlset>";

foreach($list as $k=>$qinfo){

if($k==0)

$indexArr['minid']=$qinfo['id'];

$qinfo['lastmod'] = substr($qinfo['lasttime'],0,10);

$qinfo['mobielurl'] = self::$askMobileUrl.$qinfo['id'].'.html'; //移动版链接

$qinfo['pcurl'] = self::$askPcUrl.$qinfo['id'].'-p1.html'; //pc版链接

$xml.=$this->askMapMobileUrl($qinfo); //移动版

$xml.=$this->askMapPcUrl($qinfo);     //pc版

}

$maxid = end($list);

$indexArr['maxid'] = $maxid['id'];

//更新索引文件

if($bs==0){

//更新最后一行

$txt = file($index);

$txt[count($txt)-1] = $indexArr[filename].','.$indexArr[maxid].','.$indexArr['minid'].','.$indexArr['maxXml']."\r\n";

$str = join($txt);

if (is_writable($index)) {

if (!$handle = fopen($index, 'w')) {

echo "不能打开文件 $index";exit;

exit;

}

if (fwrite($handle, $str) === FALSE) {

echo "不能写入到文件 $index";exit;

exit;

}

echo "成功地写入文件$index";

fclose($handle);

} else {

echo "文件 $index 不可写";exit;

}

fclose($index);

}elseif($bs==1){

//新加入一行

$fp = fopen($index,'a');

$num = count($list);

$string = $indexArr[filename].','.$indexArr[maxid].','.$indexArr['minid'].','.$num."\r\n";

if(fwrite($fp,$string)===false){

echo "追加新行失败。。。";exit;

}else{

echo "追加成功<br />";

//更新sitemap索引文件

$xmlData="<?xml version=\"1.0\"  encoding=\"UTF-8\" ?>".chr(10);

$xmlData.="<sitemapindex>".chr(10);

$xmlData.="</sitemapindex>";

if(!file_exists($askXml))

file_put_contents($askXml,$xmlData);

$fileList = file($askXml);

$fileCount = count($fileList);

$setmapxml = "http://www.xxx.cn/ask/setmapxml/{$filename}.xml";//正常问题链接

$txt = $this->setMapIndex($setmapxml);

$fileList[$fileCount-1]=$txt."</sitemapindex>";

$newContent = '';

foreach($fileList as $v){

$newContent.= $v;

}

if(!file_put_contents($askXml,$newContent)) exit('无法写入数据');

echo '已经写入文档' . $askXml;

}

fclose($fp);

}

$filename =  APP_PATH.'setmapxml/'.$filename.'.xml';

                //更新到xml文件中,增加结尾

                if(!file_exists($filename))

                        file_put_contents($filename,$start);

                $xmlList = file($filename);

                $xmlCount = count($fileList);

                $xmlList[$xmlCount-1]=$xml."</urlset>";

                $newXml = '';

foreach($xmlList as $v){

$newXml.= $v;

}

if(!file_put_contents($filename, $newXml))exit("写入数据错误");

                else

                    echo "写入数据成功<br />";

}

//问答移动版xml

private function askMapMobileUrl($data){

$xml = '';

if(is_array($data)&&!empty($data)){

$xml .="<url>".chr(10);

if($data['id'])

$xml.='<loc>'.$data['mobielurl'].'</loc>'.chr(10);//移动版链接

$xml.="<mobile:mobile type=\"mobile\"/>".chr(10);

if($data['lastmod'])

$xml.='<lastmod>'.$data['lastmod'].'</lastmod>'.chr(10);

$xml.='<changefreq>daily</changefreq>'.chr(10);

$xml.='<priority>0.8</priority>'.chr(10);   

$xml.="</url>".chr(10);

return $xml;

}

}

//问答pc版xml

private function askMapPcUrl($data){

$xml = '';

if(is_array($data)&&!empty($data)){

$xml.='<url>'.chr(10);

if($data['id'])

$xml.='<loc>'.$data['pcurl'].'</loc>'.chr(10);//pc版链接

if($data['lastmod'])

$xml.='<lastmod>'.$data['lastmod'].'</lastmod>'.chr(10);

$xml.='<changefreq>daily</changefreq>'.chr(10);

$xml.='<priority>0.8</priority>'.chr(10);

$xml.='</url>'.chr(10);

return $xml;

}

}

//setmaps索引文件

private function setMapIndex($filename){

$xml = '';

$xml.="<sitemap>".chr(10);

$xml.="<loc>{$filename}</loc>".chr(10);

$xml.="<lastmod>".date("Y-m-d",time())."</lastmod>".chr(10);

$xml.="</sitemap>".chr(10);

return $xml;

}

}

?>

 
xml索引文件格式如下:
<?xml version="1.0"  encoding="UTF-8" ?>

<sitemapindex>

<sitemap>

<loc>http://www.xxx.cn/ask/setmapxml/0.xml</loc>

<lastmod>2014-05-12</lastmod>

</sitemap>

<sitemap>

<loc>http://www.xxx.cn/ask/setmapxml/1.xml</loc>

<lastmod>2014-05-12</lastmod>

</sitemap>

</sitemapindex>

 
xml文件格式(每个文件需要存储5000条、现展示1条例子)
<?xml version="1.0" encoding="UTF-8" ?> 

<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:mobile="http://www.baidu.com/schemas/sitemap-mobile/1/">

<url>

<loc>http://m.xxx.cn/ask/7460.html</loc>

<mobile:mobile type="mobile"/>

<lastmod>2013-01-11</lastmod>

<changefreq>daily</changefreq>

<priority>0.8</priority>

</url>

<url>

</urlset>

 
至于sql代码主要就是一个select语句,这里就不贴出来了。

希望本文所述对大家的php程序设计有所帮助。

PHP 相关文章推荐
图象函数中的中文显示
Oct 09 PHP
用PHP 快速生成 Flash 动画的方法
Mar 06 PHP
Optimizer与Debugger兼容性问题的解决方法
Dec 01 PHP
PHP 判断常量,变量和函数是否存在
Apr 26 PHP
php后台程序与Javascript的两种交互方式
Oct 25 PHP
php在项目中寻找代码的坏味道(综艺命名)
Jul 19 PHP
php抓取页面的几种方法详解
Jun 17 PHP
Zend Guard使用指南及问题处理
Jan 07 PHP
php实现无限级分类查询(递归、非递归)
Mar 10 PHP
php+ajax实现带进度条的上传图片功能【附demo源码下载】
Sep 14 PHP
php中get_magic_quotes_gpc()函数说明
Feb 06 PHP
Laravel框架学习笔记之批量更新数据功能
May 30 PHP
php+mysql实现数据库随机重排实例
Oct 17 #PHP
php中spl_autoload详解
Oct 17 #PHP
php中__destruct与register_shutdown_function执行的先后顺序问题
Oct 17 #PHP
PHP图片自动裁切应付不同尺寸的显示
Oct 16 #PHP
PHP 抽象方法与抽象类abstract关键字介绍及应用
Oct 16 #PHP
php开启与关闭错误提示适用于没有修改php.ini的权限
Oct 16 #PHP
php实现扫描二维码根据浏览器类型访问不同下载地址
Oct 15 #PHP
You might like
php下封装较好的数字分页方法
2010/11/23 PHP
mysqli_set_charset和SET NAMES使用抉择及优劣分析
2013/01/13 PHP
一个简单的php加密解密函数(动态加密)
2013/06/19 PHP
PHP实现抓取迅雷VIP账号的方法
2015/07/30 PHP
php 输入输出流详解及示例代码
2016/08/25 PHP
php+mysql开发中的经验与常识小结
2019/03/25 PHP
jquery tools之tabs 选项卡/页签
2009/07/25 Javascript
jQuery获取浏览器中的分辨率实现代码
2013/04/23 Javascript
探讨在JQuery和Js中,如何让ajax执行完后再继续往下执行
2013/07/09 Javascript
Jquery ajax执行顺序 返回自定义错误信息(实例讲解)
2013/11/06 Javascript
鼠标滑过出现预览的大图提示效果
2014/02/26 Javascript
JavaScript的函数式编程基础指南
2016/03/19 Javascript
微信小程序 密码输入(源码下载)
2017/06/27 Javascript
JS原生轮播图的简单实现(推荐)
2017/07/22 Javascript
Vue.js项目模板搭建图文教程
2017/09/20 Javascript
vue.extend实现alert模态框弹窗组件
2018/04/28 Javascript
jQuery实现回到顶部效果
2020/10/19 jQuery
[50:02]完美世界DOTA2联赛循环赛 Magma vs IO BO2第一场 11.01
2020/11/02 DOTA
python实现线程池的方法
2015/06/30 Python
Python3.5 Pandas模块之DataFrame用法实例分析
2019/04/23 Python
详解python中*号的用法
2019/10/21 Python
Centos7 下安装最新的python3.8
2019/10/28 Python
python3 实现函数写文件路径的正确方法
2019/11/27 Python
Python多进程编程multiprocessing代码实例
2020/03/12 Python
CSS3中的注音对齐属性ruby-align用法指南
2016/07/01 HTML / CSS
html5实现滑块功能之type=&quot;range&quot;属性
2020/02/18 HTML / CSS
AmazeUI 面板的实现示例
2020/08/17 HTML / CSS
简述网络文件系统NFS,并说明其作用
2016/10/19 面试题
最新党员的自我评价分享
2013/11/04 职场文书
电子商务专业推荐信范文
2013/12/02 职场文书
2014年社区工会工作总结
2014/12/18 职场文书
文明班级申报材料
2014/12/24 职场文书
简短清晨问候语
2015/11/10 职场文书
生活委员竞选稿
2015/11/21 职场文书
web前端之css水平居中代码解析
2021/05/20 HTML / CSS
springBoot基于webSocket实现扫码登录
2021/06/22 Java/Android