网络搜索 API
网络搜索 API 是一种服务,它允许软件查询搜索引擎的网页索引,并以结构化数据的形式获取结果,而无需通过浏览器或抓取搜索结果页面。 程序发送包含查询内容和参数的请求,随后接收机器可读的结果(通常包括 URL、标题和文本片段,以及新闻、图像、视频和更丰富的内容),这些结果可直接用于 AI 应用程序。
简而言之:网络搜索 API 就是软件搜索网络的方式——发送查询请求,获取可用于后续处理的结构化结果,无需浏览器或抓取操作。
网络搜索 API 运行机制
提供商负责运营搜索基础设施,开发人员只需发送查询并接收数据:
- 维护索引:提供商会持续爬取并索引网络内容,以此构建 API 背后的可搜索语料库。 (注意,网络抓取器通常不会维护自己的网页索引。)
- 身份验证:开发者使用 API 密钥调用某个端点,该密钥用于识别账户,并根据套餐对使用量进行计费。
- 带参数的查询:请求中包含查询内容以及各种选项,例如结果数量、时效性、国家/地区和安全搜索设置。
- 排序与返回:服务会对匹配的页面进行排序,并以结构化 JSON 格式返回结果,通常按网页、新闻、图片和视频结果进行分组。
- 程序化使用:应用程序解析这些结构化结果,用于构建搜索用户界面、按类型或时效性进行显示或筛选,或者将结果作为接地上下文提供给大型语言模型。
其核心特征在于,网络搜索 API 将搜索功能转化为了一个可复用的构建模块:它返回的不是供人类阅读的网页,而是供软件程序处理的整洁数据。
网络搜索 API 对比面向消费者的搜索引擎及数据抓取
- 面向消费者的搜索引擎是用户直接访问的网站;而网络搜索 API 则是以数据形式向软件提供同类搜索能力的工具。
- 可编程搜索引擎是底层的搜索系统;网络搜索 API 则是开发人员用于查询该系统的接口。 在产品营销中,这两个术语有时会被互换使用,但严格来说,API 是应用程序与引擎进行交互的途径。
- 网络抓取会解析已渲染的结果页面,这种方法不稳定且通常被禁止;而正规的网络搜索 API(基于其自身的索引)则提供经过授权的结构化的结果访问方式,这些结果经过优化,便于机器处理。
网络搜索 API 的应用场景
- 构建搜索功能:无需自行运行网络爬虫和构建索引,即可为网站、应用或垂直领域搜索提供支持。
- 网络接地与 RAG:提供新鲜、可引用的网络内容,作为网络接地和RAG 的检索层,使模型能够回答有关当前世界的问题。
- AI 智能体和工具:充当智能体在执行查询任务时调用的网络搜索工具。
- Brave 搜索 API:Brave 搜索 API是一个基于 Brave 自有索引(包含超过 400 亿个网页)的独立网络搜索 API,它提供针对网页、新闻、图片、视频和本地搜索结果的结构化接口,此外还包含为大型语言模型接地而预先提取的内容。 与其他 API 一样,它的使用受限于特定的套餐及速率限制;其覆盖范围、数据时效性和延迟表现决定了您能基于此构建何种应用。
网络搜索 API 是将应用程序与实时网络连接起来的桥梁——它是 AI 回答引擎、具备事实依据的智能助手以及任何“主动搜索”类产品(而非“被搜索”类产品)的基石。
相关术语
搜索 API、可编程搜索引擎、 网络接地、 检索增强生成 (RAG)、 SERP、SERP 功能、AI 网络爬虫、速率限制、延迟、AI 答案引擎。