判断是否为爬虫的请求

User-Agent是Http协议中的一部分,属于头域的组成部分,User Agent也简称UA。用较为普通的一点来说,是一种向访问网站提供你所使用的浏览器类型、操作系统及版本、CPU 类型、浏览器渲染引擎、浏览器语言、浏览器插件等信息的标识。UA字符串在每次浏览器 HTTP 请求时发送到服务器!

判断浏览器请求类型的方法,见如下代码:

1.Java代码:
public static boolean isRobotRequest(HttpServletRequest request) {
String userAgent = request.getHeader("user-agent");
if (userAgent == null)
return false;

userAgent = userAgent.toLowerCase();

if (userAgent.contains("spider")) {
return true;
} else if (userAgent.contains("bot")) {
return true;
} else if (userAgent.contains("nutch")) {
return true;
} else if (userAgent.contains("yahoo")) {
return true;
} else if (userAgent.contains("gougou")) {
return true;
} else if (userAgent.contains("scooter")) {
return true;
} else if (userAgent.contains("lilina")) {
return true;
}

return false;
}

2.JS代码:
使用navigator.userAgent来获得
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值