您现在的位置是:网站首页> 编程资料编程资料
使用shell脚本找出网站的空页面和404错误页面_linux shell_
2023-05-26
288人已围观
简介 使用shell脚本找出网站的空页面和404错误页面_linux shell_
早之前记的一个笔记了,之前只是记录了两句代码,放出来的话也是一个低质量的页面,于是设置为了仅自己可见,今晚抽空补充一下。
记得当的情景应该是提交sitemap时百度老提示有错误的URL,导致sitemap不能正常被抓取,于是在想办法解决这个问题,所以才有下面这些笔记:用shell批量找出网站空页面和404错误页面。
废话不多说,直接上shell代码:
复制代码 代码如下:
time cat sitemap.txt|while read line;do curl -l $line -m 5 --connect-timeout 5 -o /dev/null -s -w "$line "%{http_code}" "%{size_download}"\n";done
前面加了一个time是为了看看代码执行所花的时间
%{http_code}意思是返回HTTP状态码,通过这个状态码我们就能知道该链接是正常的200链接,还是404错误链接;
%{size_download}意思是返回当前页面的大小,如果值太小的话,说明这些页面很有可能是低质量的空页面,得想办法剔除掉。
相关内容
- Shell实用技巧:快速去除字符串中的空格_linux shell_
- Shell脚本批量添加扩展名的两种方法分享_linux shell_
- Shell脚本实现的单机流量统计功能_linux shell_
- Shell脚本模拟多线程功能分享_linux shell_
- Shell去除空行的4种方法_linux shell_
- Shell函数的7种用法介绍_linux shell_
- Shell脚本实现随机数多种方法介绍(date、random、uuid)_linux shell_
- Shell脚本中不同进制数据转换的例子(二进制、八进制、十六进制、base64)_linux shell_
- Shell脚本对文件中的行、单词、字符进行迭代输出示例_linux shell_
- Shell脚本制作的终端会话回放功能脚本分享_linux shell_
