读取网络数据涉及从 URL、REST API 和网页直接获取数据到 Python 中。这允许分析工作流在不手动下载的情况下整合实时或频繁更新的数据。主要工具是用于 API 的 requests 库,以及用于网络抓取的 BeautifulSoup 或 scrapy。
requests
BeautifulSoup
scrapy