四虎精品视频-四虎精品成人免费网站-四虎黄色网-四虎国产视频-国产免费91-国产蜜臀97一区二区三区

PHP統計nginx訪問日志中的搜索引擎抓取404鏈接頁面路徑

我在服務器上有每天切割nginx日志的習慣,所以針對每天各大搜索引擎來訪,總能記錄一些404頁面信息,傳統上我只是偶爾分析下日志,但是對于很多日志信息的朋友,人工來篩選可能不是一件容易的事情,這不我個人自己慢慢研究了一點點,針對谷歌、百度、搜搜、360搜索、宜搜、搜狗、必應等搜索引擎的404訪問生成為一個txt文本文件,直接上代碼test.php

復制代碼 代碼如下:
<?php
//訪問test.php?s=google
$domain='http://www.jb51.NET';
$spiders=array('baidu'=>'Baiduspider','360'=>'360Spider',
'google'=>'Googlebot','soso'=>'Sosospider','sogou'=>
'Sogou web spider','easou'=>'EasouSpider','bing'=>'bingbot');
 
$path='/home/nginx/logs/'.date('Y/m/').(date('d')-1).'/access_www.txt';
 
$s=$_GET['s'];
 
if(!array_key_exists($s,$spiders)) die();
$spider=$spiders[$s];
 
$file=$s.'_'.date('ym').(date('d')-1).'.txt';
if(!file_exists($file)){
    $in=file_get_contents($path);
    $pattern='/GET (.*) HTTP//1.1" 404.*'.$spider.'/';
    preg_match_all ( $pattern , $in , $matches );
    $out='';
    foreach($matches[1] as $k=>$v){
        $out.=$domain.$v."/r/n";
    }
    file_put_contents($file,$out);
}
 
$url=$domain.'/silian/'.$file;
echo $url;

好就這樣了。沒有什么高深的技術,只有動手寫的過程。

php技術PHP統計nginx訪問日志中的搜索引擎抓取404鏈接頁面路徑,轉載需保留來源!

鄭重聲明:本文版權歸原作者所有,轉載文章僅為傳播更多信息之目的,如作者信息標記有誤,請第一時間聯系我們修改或刪除,多謝。

主站蜘蛛池模板: 尹雪喜演的电影在线观看 | 抗日电影血战日寇| 解决问题五上数学| 青蛙王子 电影| 女女女爱| 圣斗士星矢在线观看| 守护甜心几梦做了| 都市频道在线直播回放| 毕业论文3000字范文| 色在线看| 奇骏车友会| 李保田最经典十部电影| 电视剧《反击》主要演员| 八年级上册英语课文| 香港论理| 九九九九九九九九九九热| 秀人网美女屋| 追捕电影国语版完整版| 涩谷天马| superstar电影在线播放| 诱惑热舞| 第一财经直播电视直播 现场直播| 塔木德全文阅读免费| 黄视频在线网站| 李耀| 王岗个人简历| 肥皂泡节选阅读理解答案三年级| 被出租车司机带到野外c| 女攻男受调教道具| 金秘书为什么那样| 贝的故事教案设计优秀教案| 丧尸童子军| 瑜伽教练韩国电影| 膨腹爱好者撑肚子视频| dj舞曲超劲爆dj| 大国医 电视剧| cctv17农业农村频道在线直播| 吴京的《战狼3》| 《身边有特点的人》作文| 志村大爆笑| 冬日行动电影免费观看|