您现在的位置是：首页 > 工具

当前栏目

Apache 网站日志分析

Apache 日志网站分析

2023-09-11 14:18:15 时间

1.获得访问前 10 位的 ip 地址

[root@apache ~]# cat access_log |awk '{print $1}'|sort|uniq -c|sort -nr|head -10

2.访问次数最多的文件或页面,取前 20

cat access.log|awk ‘{print $11}’|sort|uniq -c|sort -nr|head -20

3.列出传输最大的几个 exe 文件

cat access.log |awk ‘($7~/\.exe/){print $10 ” ” $1 ” ” $4 ” ” $7}’|sort -nr|head -20

4. 列出输出大于 200000byte(约 200kb)的 exe 文件以及对应文件发生次数

cat access.log |awk ‘($10 > 200000 && $7~/\.exe/){print $7}’|sort -n|uniq -c|sort -nr|head -100

5. 如果日志最后一列记录的是页面文件传输时间，则有列出到客户端最耗时的页面

cat access.log |awk ‘($7~/\.php/){print $NF ” ” $1 ” ” $4 ” ” $7}’|sort -nr|head -100

6. 列出最最耗时的页面(超过 60 秒的)的以及对应页面发生次数

cat access.log |awk ‘($NF > 60 && $7~/\.php/){print $7}’|sort -n|uniq -c|sort -nr|head -100

7. 列出传输时间超过 30 秒的文件

cat access.log |awk ‘($NF > 30){print $7}’|sort -n|uniq -c|sort -nr|head -20

8. 统计网站流量（G)

cat access.log |awk ‘{sum+=$10} END {print sum/1024/1024/1024}’

9. 统计 404 的连接

awk ‘($9 ~/404/)’ access.log | awk ‘{print $9,$7}’ | sort

10. 统计 http status.

cat access.log |awk ‘{counts[$(9)]+=1}; END {for(code in counts) print code, counts[code]}'

cat access.log |awk '{print $9}'|sort|uniq -c|sort -rn

11. 蜘蛛分析

查看是哪些蜘蛛在抓取内容。

/usr/sbin/tcpdump -i eth0 -l -s 0 -w - dst port 80 | strings | grep -i user-agent | grep -i -E

'bot|crawler|slurp|spider'

Webalizer 日志分析程序

[root@Apache-Server tools]# yum install -y webalizer

[root@Apache-Server tools]# less /etc/webalizer.conf

http://maofan.blog.51cto.com/9212198/1560639

猜你喜欢

JS的Date对象
ERP企业管理系统报价？购买一套ERP需要多少钱？
Atitit 数据结构与常见文件元数据结构目录 1. 分类内部数据结构与外部存储数据结构1 2. 编程语言内部数据结构（堆栈树图等1 2.1. 数据结构（集合，列表，tree，map
Tkinter的Canvas控件
uwp 之多媒体开发
Java实现蓝桥杯VIP 算法提高三角形面积
多个ViewPager引发的Fragment未初始化
前端公共图表数据大盘方案
Java如何获取正在运行的线程的Id？
数据库-存储过程
Java实现 LeetCode 212 单词搜索 II
PC-修改IE 与禁止修改IE

相关主题

Ubuntu apache
LAMP之Apache
linux-安装apache
Apache介绍
apache支持php
apache配置php
配置Apache
Apache 安装配置
Apache日志
Apache 是什么
Apache -poi
Apache Shiro 手册
Apache的安装
apache和tomcat

zl程序教程

当前栏目

Apache 网站日志分析

相关文章