首頁 >後端開發 >php教程 >[日誌分析]在nginx日誌中,提取有效的request uri

[日誌分析]在nginx日誌中,提取有效的request uri

WBOY
WBOY原創
2016-08-08 09:19:231183瀏覽
最近在做公司的nginx log分析,其中一個需求是提取這個月每天被訪問Top10的頁面,及其訪問量。 做這個需求,首先要清洗出有效的頁面訪問。我採用排除法,去掉 .js .css之類的存取。但最初,我並不能全面的了解要去掉有哪些後綴的request。 經過清洗-> 抽樣-> 清洗-> 抽樣-> 清洗,最終需要過濾掉含有下列後綴的uri
.js  .cs . gif .jpeg  .jpg . xml .JPEG .PNG .JPG 
#python代码:
if re.search(r"(\.js|\.css|\.gif|\.jpe?g|\.png|\.ico|\.txt|\.swf|\.JPE?G|\.PNG|\.xml)", request[1]):
        continue

不同公司的日誌可能存在一些特殊情況,這還需要抽樣分析

版權聲明:本文為部落客原創文章,未經博主轉載。

以上就介紹了[日誌分析]在nginx日誌中,提取有效的request uri,包括了方面的內容,希望對PHP教程有興趣的朋友有所幫助。

陳述:
本文內容由網友自願投稿,版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容,請聯絡admin@php.cn