AI搜索API对比评测:豆包搜索与Serper谁更适合Agent

如何挑选适配AI Agent的搜索API?
搜索是AI智能体(Agent)的核心基础能力之一,大语言模型的知识边界停留在训练截止节点,后续的实时信息、动态数据都需要通过检索来补充完善。
值得注意的是当前行业的一个有趣现象:大量团队聚焦于Agent的开发,却鲜少有人深耕搜索技术,就连以搜索起家的Google,其Gemini集成的搜索功能效果也出现了明显下滑。
但在实际为Agent接入搜索能力时会发现,单纯的网页搜索结果往往无法满足需求。
例如Agent需要查询的很多信息并非静态网页内容:实时汇率、当日股价这类动态数据,往往无法在常规网页中及时获取到准确结果。
作为推理系统,AI Agent的表现完全依赖于上下文信息的质量,想要提升其信息检索能力,就必须从AI搜索服务的输出质量入手进行优化。
目前海外搜索API市场基本以Google为底层支撑,但直接调用原生Google搜索的开发者并不多,大多会通过中间层封装。这类封装服务可以分为两类:一类是轻量封装,比如Serper、SerpAPI,仅将Google的原始搜索结果整理为JSON格式返回;另一类是深度封装,比如Tavily、Exa、Brave Search API,会自行完成召回、排序流程,其中Exa还搭建了专属的搜索索引。国内也有多家厂商推出了搜索API服务,包括博查、豆包搜索、智谱以及阿里云等平台。
本次评测选取了Serper和豆包搜索作为测试对象:选择Serper是因为它属于轻量封装类型,基本等同于直接获取Google的原始搜索结果;而豆包搜索则是国内刚正式开放、可控参数最为全面的服务之一,本次仅作为参考示例,开发者可根据自身业务需求选择合适的搜索API。
本次测试覆盖了多个实际应用场景,以下选取几个核心场景进行详细分析:
口语化查询改写能力
测试使用了一句完全口语化的提问:“就是那个有灵魂的那个 AI agent 叫什么来着,好像说自己有意识还是什么的,特别火”。测试结果显示,豆包搜索召回了10条结果,首条命中ColaOS,后续还包含InfoQ对SOUL.md的逐句解读;而Google仅召回3条结果,分别是2022年的搜狐旧闻、一条YouTube视频以及一条答非所问的腾讯新闻。
实际应用中,AI Agent接收到的用户输入大多属于这类口语化表述,很少有用户会先将问题整理为标准关键词再提交。
结构化数据返回(汇率查询)
当查询日元兑人民币汇率时,豆包搜索直接返回了结构化的卡片信息,包含1 CNY = 24.192 JPY、1 JPY = 0.0413 CNY的双向换算数据,同时带有更新时间戳;而Google搜索则返回了Wise、新浪财经、XE等五个链接,用户需要再次发起请求抓取链接内容才能获取具体汇率数值。
实时行情数据获取(股价查询)
当查询科大讯飞当日股价时,豆包搜索返回了完整的行情卡片:股票代码002230,当前价格¥38.88,下跌1.61元,跌幅3.98%,数据更新时间戳为15:49,同时标注了休市状态;而Google搜索返回了东方财富、雪球、富途的行情页链接,其中搜狐证券的结果标题中带有过时的40.97元数值。
跨语言搜索能力(中文提问英文事件)
在Claude Opus 5发布次日,使用中文进行提问测试。豆包搜索同时召回了Anthropic官网的Introducing Claude Opus 5官方原文,以及IT之家、超能网的中文解读内容;而Google搜索的索引尚未更新,返回的结果为上一代Sonnet 5的公告、一条YouTube推测视频以及一条Reddit猜测帖。需要说明的是,Google搜索针对英文query的时效性表现通常更优,本次测试场景为中文提问,因此存在一定差异。
时效性过滤功能(限定24小时内结果)
当设置限定一天内的搜索范围时,豆包搜索返回的10条结果全部为当日的中文资讯,包括人民网转载经济日报的Kimi K3报道、腾讯早报以及新浪转载中国经营报的WAIC观察内容;而Google搜索的结果中混杂了Threads的聊天帖、台媒的YouTube视频以及鉅亨網的繁体摘要,时效性过滤效果不佳。
信源权威度筛选(医药政策查询)
当搜索HPV疫苗扩龄政策并将权威度过滤设置为“非常权威”时,豆包搜索返回的10条结果全部来自温州市卫健委、吉林省疾控局、芜湖市政府、正蓝旗政府等官方渠道;而Google搜索没有权威度筛选维度,返回结果中包含医院预约套餐页、北大医院接种须知、百度百科词条等内容,与政府网站结果混排在一起。
英文学术搜索场景
当搜索continual learning的综述论文时,Google搜索返回了arXiv预印本、ACM正式出版论文、Wang-ML-Lab的配套代码仓库以及ResearchGate等全套学术资源;而豆包搜索的结果以生物通的中文解读打头,仅附带arXiv和OpenReview的链接,学术资源的纵深覆盖程度不如Google搜索。
整体测试结束后可以发现,豆包搜索的核心优势集中在结构化数据返回、权威信源筛选、时效性过滤以及中文场景适配这几个方面。
具体来看,豆包搜索有几个超出预期的实用功能:
第一个是结构化卡片输出:针对汇率、股价这类查询,能够直接返回标准化字段信息,汇率卡片包含双向换算数据和更新时间,股价卡片则包含股票代码、当前价格、涨跌额、涨跌幅以及休市状态等完整信息。
第二个是权威度分级筛选:每条搜索结果自带权威度标注,开发者可以在请求参数中设置仅返回“非常权威”的结果。
第三个是精准的时效性过滤:将TimeRange设置为一天后,返回的结果全部为当日最新内容。
此外,查询改写和垂类参数配置功能,也能够有效提升搜索结果的整体质量。
在调用额度方面,Serper注册时会赠送2500次一次性调用次数,用完后需要自行购买;而豆包搜索每月会赠送500次调用额度,每月刷新,折算下来每日可使用十余次。
超出额度后的付费成本相对较低,与当前大模型的推理成本相比,搜索API的调用费用几乎可以忽略不计,单次搜索的成本甚至不到一轮长上下文推理的零头。
豆包搜索的访问地址:https://console.volcengine.com/search-infinity/web-search-exp
PS 1:本次测试于上周六完成,请将文中的“今日”自行替换为测试当日的周六日期。
PS 2:本次测试为完全客观的脚本测试,开发者可自行重复验证,本次测试的搜索脚本使用Doubao-Seed-Evolving模型编写完成。


