我正在尝试抓取这个网站:https ://www.senate.gov/general/contact_information/senators_cfm.cfm
我的代码:
import requests
from bs4 import BeautifulSoup
URL = 'https://www.senate.gov/general/contact_information/senators_cfm.cfm'
page = requests.get(URL)
soup = BeautifulSoup(page.content, 'html.parser')
print(soup)
问题是它实际上并没有进入该站点。我在汤 var 中获得的 HTML 根本不是正确网页中的 HTML。
我不确定从这里去哪里!任何和所有的帮助将不胜感激。