import requests
# 使用 requests 库来抓取网页的 HTML 内容
def fetch_html(url):
try:
# 发送 HTTP 请求
response = requests.get(url)
# 检查请求是否成功
if response.status_code == 200:
# 返回网页的 HTML 内容
return response.text
else:
return "error"
except Exception as e:
return "error"
# 示例:抓取百度首页的 HTML
url = "https://www.baidu.com"
html_content = fetch_html(url)
if html_content != "error":
print(html_content[:1000]) # 打印前1000个字符
else:
print("抓取失败")
导入库:我们使用 requests 库来发送 HTTP 请求并获取网页内容。如果你还没有安装这个库,可以通过 pip install requests 来安装。
定义函数:fetch_html(url) 函数用于抓取指定 URL 的 HTML 内容。
发送请求:通过 requests.get(url) 发送 GET 请求到指定的 URL。
示例调用:通过 fetch_html(url) 抓取百度首页的 HTML,并打印前 1000 个字符。
如果你需要抓取其他网站的 HTML,只需修改 url 变量即可。
上一篇:html5下载
下一篇:带格式文本rtf和html的区别
Laravel PHP 深圳智简公司。版权所有©2023-2043 LaravelPHP 粤ICP备2021048745号-3
Laravel 中文站