API 术语表
F
- 分词
- 分词是将文本拆分为较小单元(即“词元”)的过程,这些词元是系统实际处理的对象。 对于语言模型而言,词元通常是子词片段,模型将其作为数字而非完整单词来读取。 在传统搜索中,分词则是将文本拆分为用于构建索引和查询索引的词项。 无论哪种情况,分词都是将原始文本转化为系统可处理单元的关键步骤。
S
- SERP 功能
- SERP 功能是指搜索引擎结果页面上的一系列富化模块,其内容超出了标准自然搜索结果列表的范围。 常见的例子包括精选摘要、知识面板、“其他人也在问”版块、图片和视频轮播、本地地图包、头条新闻版块、购物模块以及 AI 生成的概览。
- 搜索引擎结果页 (SERP)
- 搜索引擎结果页 (SERP) 是指搜索引擎针对用户查询返回的页面。 在现代搜索引擎中,搜索结果通常是由多种元素组成的,而不仅仅是简单的列表:包括按排名显示的自然(非付费)链接、付费广告,以及诸如精选摘要或知识面板等能够直接回答部分查询内容的 SERP 特色模块。 针对某些查询和搜索引擎,页面顶部附近可能还会显示由 AI 生成的摘要内容。
- 速率限制
- 速率限制是指对客户端(通常是计算机或移动设备上的应用程序)在特定时间内向某项服务发出的请求数量设定上限的做法。 当客户端超过限制时,服务会拒绝或延迟后续请求(通常返回 HTTP 429 Too Many Requests 响应),直到时间窗口重置。 速率限制可保护服务免受过载影响,确保用户之间公平使用,并强制执行许多 API 所销售的使用层级方案。
W
- 网络搜索 API
- 网络搜索 API 是一种服务,它允许软件查询搜索引擎的网页索引,并以结构化数据的形式获取结果,而无需通过浏览器或抓取搜索结果页面。 程序发送包含查询内容和参数的请求,随后接收机器可读的结果(通常包括 URL、标题和文本片段,以及新闻、图像、视频和更丰富的内容),这些结果可直接用于 AI 应用程序。
- 网络抓取器
- 网络抓取器是一种能够从网站(包括搜索引擎结果页面)自动提取数据的程序,通常通过下载网页并解析为人类浏览器编写的 HTML 代码来实现;网络抓取器能够将原本供人类阅读的内容转换为结构化数据,以便计算机程序进行存储和重复利用。 网络抓取器有许多正当用途(包括价格比对、研究、归档和系统监控),但根据抓取的内容和方式,它们可能会引发法律、技术和政策方面的问题。 在搜索场景中,网络抓取器通过加载并解析搜索引擎的结果页面来提取结果——许多主要服务商都会通过服务条款和反自动化政策来限制或禁止这种做法。
Z
- 智能体搜索
- 智能体搜索是一种检索方法,其中 AI 智能体(通常由大型语言模型驱动)会主动规划并执行多步骤搜索流程,而不是仅仅进行单次静态查询。 该智能体会分解查询请求,决定咨询哪些数据源或工具,发起多次搜索,评估搜索结果,并循环优化其方法,直到收集到足够的信息来回答问题为止。