网页 API 文档与端点目录
网页 API 部分涵盖了用于获取公开页面作为原始 HTML、浏览器渲染的 HTML 或清洗后的 Markdown 的通用爬取端点。
当您需要网页内容提取、监控、元数据采集或适用于大语言模型的内容处理流程,而不依赖 Google SERP 专用接口时,请使用这些 API。
可用 API
| 接口 | 方法 | 说明 |
|---|---|---|
| 网页 HTML 抓取 API | GET | 获取网页抓取数据,包括返回完整的原始 HTML 内容,快速且经济高效,针对静态页面抓取优化,适用于爬取、元数据提取和页面结构分析。 |
| 网页渲染 HTML 抓取 API | GET | 获取网页抓取数据,包括返回完整的原始渲染 HTML 内容,快速且成本效益高,针对静态页面抓取进行了优化,适用于爬取、元数据提取和页面结构分析。 |
| 网页 Markdown 抓取 API | GET | 获取网页抓取数据,包括去除样板内容,用于可读提取、文档工作流和LLM输入。 |
