我正在尝试从Sofascore网站(我使用python & Selenium)抓取特定匹配的数据。
我可以先去https://www.sofascore.com/football/2022-05-12,然后用url https://www.sofascore.com/arsenal-tottenham-hotspur/IsR点击热刺-阿森纳的比赛。
但是,当我从浏览器中直接输入这个链接时,我会到达一个完全不同的页面,为以后的比赛做准备。
是否有一种方法来区分这2页,以便能够刮除原始匹配?谢谢
发布于 2022-08-08 21:02:01
我查了你说过的那几页。第一页(https://www.sofascore.com/football/2022-05-12)向服务器发送大量信息。
所以你才会有一页。如果您想用requests解决这个问题,您将需要记录它通过Burp套件或类似工具发送的所有内容。
你最好用selenium打开它,然后点击第一页,得到你想要的页面.
如果您想要检查selenium中当前页面的内容,可以检查内容是否是您希望在该页面上出现的内容.
琼森
https://stackoverflow.com/questions/73283472
复制相似问题