Selenium绕过爬虫检测(终极方案)
创始人
2024-09-25 02:22:15

众所周知,Selenium是一个用于自动化Web应用程序测试的工具,通过控制浏览器执行这些脚本来模拟用户的操作。但是,太容易被检测!通过Selenium启动的浏览器,有很多的特征能够被检测出来,进而触发验证码、滑块等。

网上有很多的防检测方法,大都是掩耳盗铃,对于一些网站来说没什么效果。只要使用Selenium启动浏览器,必定会被检测到。

通过访问 sannysoft 可以看到,使用Selenium启动的网站,不管用了什么防检测,都会被检测出来。

既然使用Selenium启动浏览器就会被检测到,那该如何绕过检测?

没错,那就是不用Selenium启动。我们可以通过手动启动浏览器,并用Selenium连接此浏览器,达到完美的防检测。但是我们既然用Selenium,肯定是为了自动化,不可能每次都先手动打开浏览器。

我们可以使用subprocess 来启动浏览器,再用Selenium连接,来完成这一流程。

话不多说,直接进入正题:

(此次需要用到的插件,没有安装的小伙伴可以自行安装一下)

browser_path = "C:\\Program Files\\Google\\Chrome\\Application\\chrome.exe"  subprocess.Popen([browser_path,'--remote-debugging-port=9222'])

使用subprocess命令行打开浏览器,并且添加参数,给此次启动的浏览器添加一个9222的端口。browser_path 的值是你电脑里谷歌浏览器的路径,windows一般是这个。

options = Options() options.add_experimental_option("debuggerAddress", "127.0.0.1:9222") driver = webdriver.Chrome(executable_path='C:\\Program Files\\Google\\Chrome\\Application\\chromedriver.exe', options=options)  driver.get('https://bot.sannysoft.com/')

然后通过Selenium的设置浏览器选项,通过上面的端口,连接上浏览器。executtable_path的路径和上面一样。

最后直接访问地址,可以看到,我们这个完全和手动打开的浏览器一模一样,成功的绕过了所有检测。

最后,贴上完整代码

from selenium import webdriver from selenium.webdriver.chrome.options import Options import subprocess import time  browser_path = "C:\\Program Files\\Google\\Chrome\\Application\\chrome.exe"  subprocess.Popen([browser_path,'--remote-debugging-port=9222'])  time.sleep(3)  options = Options() options.add_experimental_option("debuggerAddress", "127.0.0.1:9222") driver = webdriver.Chrome(executable_path='C:\\Program Files\\Google\\Chrome\\Application\\chromedriver.exe', options=options)  driver.get('https://bot.sannysoft.com/')

大功告成!

相关内容

热门资讯

原创 中... 在阅读文章前,辛苦您点下“关注”,方便讨论和分享。作者定会不负众望,按时按量创作出更优质的内容 文...
影石创新遭巨头“密集攻击”?刘... 来源:市场资讯 (来源:达摩财经) 影石创新日前正式发布全球首款全景无人机“影翎Antigravi...
欧盟调查谷歌利用网络内容支持A... 新华社布鲁塞尔12月9日电(记者丁英华 张兆卿)欧盟委员会9日宣布,对美国谷歌公司利用网络内容为其人...
圣奥化学公布新型绿色防老剂SA... 来源:市场资讯 (来源:中国化工信息周刊) 关键词 | 圣奥化学SA6000开发进展 共 1064字...
人工智能也有“真香定律”!从科... 潮新闻客户端 记者 谢春晖 通讯员 姜慧君 方临明 人工智能浪潮奔涌。从率先布局抢占赛道先机,到...