# Oran Ge 对比测试 Serper 与豆包搜索的 Agent 信息检索能力

- 来源：Orange AI (@oran_ge)
- 发布时间：2026-07-28 08:45
- AIHOT 分数：48
- AIHOT 链接：https://aihot.virxact.com/items/cms3ybi7003zyro82edcig8d0
- 原文链接：https://x.com/oran_ge/status/2081903867055468616

## AI 摘要

博主 Oran Ge 测试发现，豆包搜索在口语化 Query 改写、结构化数据（汇率/股价）、中文时效性及信源权威度分级上优于 Serper（Google 原始结果），例如口语输入“有灵魂的 AI agent”首条命中 ColaOS。但英文论文检索 Google 仍占优势。豆包搜索每月免费 500 次，支持结构化卡片、权威度过滤和时效过滤。

## 正文

http://x.com/i/article/2081903207090139136

# 提升 Agent 的信息搜索能力

众所周知，搜索是 Agent 最基础的能力之一。模型的知识停在训练截止那天，那之后的事全靠检索补回来。

但是这个行业最吊诡的事情是大家都在做 Agent，快没人做搜索了，甚至连搜索起家的 Google 做的 Gemini，其搜索效果都越来越差。

如果真的要给 Agent 接起来会发现，光有网页的搜索结果其实很不够用。

比如 Agent 要处理的很多信息其实不是网页。汇率现在多少，股票今天涨跌多少。这些答案可能网页里都不能及时出现。

Agent 是个推理系统，Context 决定了一切。要提高 Agent 的信息检索能力，就得从 AI 搜索结果这一端做提升。

搜索这块，海外基本以 Google 为中心，但很少有人直接对着 Google 用，一般都会包一层。薄的像 Serper、SerpAPI，把 Google 的原始结果整理成 JSON 交给你；厚的像 Tavily、Exa、Brave Search API，会自己做召回和排序，Exa 还自建了索引。国内也有几家，博查、豆包搜索，智谱和阿里云也都开了搜索 API。

我这次以 Serper 和豆包搜索为例，做了一轮综合评测。选 Serper 是因为它够薄，基本等于直接看 Google 的原始结果；选豆包搜索是因为它是国内这批里刚正式开放、可控参数给得最全的一家，这里只是作为示例，你可根据自己的业务类型自行选择任意搜索。

这次测试了很多场景，我挑了几个比较重要的场景来详细分析：

# Query 改写|口语化输入

我用了一句完全口语的输入："就是那个有灵魂的那个 AI agent 叫什么来着，好像说自己有意识还是什么的，特别火"。豆包召回 10 条，首条命中 ColaOS，后面跟着 InfoQ 对 SOUL.md 的逐句解读。Google 只召回 3 条，一条 2022 年的搜狐旧闻，一条 YouTube 视频，一条腾讯新闻答非所问。

Agent 收到的用户输入基本都是这个样子，很少有人会先把 query 整理成关键词再交给它。

# 结构化数据|汇率

问日元兑人民币汇率。豆包返回一张结构化卡片，1 CNY = 24.192 JPY，1 JPY = 0.0413 CNY，带更新时间戳。Google 返回 Wise、新浪财经、XE 五个链接，想知道数值还得再发一次请求去抓。

# 实时行情|股价

问科大讯飞今日股价。豆包给出行情卡片：002230，¥38.88，跌 1.61，跌幅 3.98%，时间戳 15：49，休市。Google 返回东方财富、雪球、富途的行情页链接，搜狐证券那条标题里带了个 40.97，是过时数字。

# 跨语言|中文提问英文事

Claude Opus 5 发布次日，用中文问。豆包同时召回 Anthropic 官网的 Introducing Claude Opus 5 原文，和 IT之家、超能网的中文解读。Google 索引还没跟上，返回的是上一代 Sonnet 5 的公告，加一条 YouTube 推测视频和一条 Reddit 猜测帖。

需要说明，Google 对英文 query 的时效性通常更好，这一组是中文提问的场景。

# 时效性过滤|限定 24 小时

同样限定一天内。豆包 10 条全是当天的中文资讯，人民网转经济日报的 Kimi K3 报道、腾讯早报、新浪转中国经营报的 WAIC 观察。Google 混进来 Threads 的聊天帖、台媒的 YouTube 视频、鉅亨網的繁体摘要。

# 信源权威度|医药政策

搜 HPV 疫苗扩龄政策，把权威度过滤开到只要"非常权威"。豆包 10 条全部来自温州市卫健委、吉林省疾控局、芜湖市政府、正蓝旗政府。Google 没有这个维度，返回里有医院的预约套餐页、北大医院的接种须知、百度百科词条，和政府网站混排在一起。

英文学术|Google 更好

搜 continual learning 的综述论文。Google 返回 arXiv 预印本、ACM 正式出版、Wang-ML-Lab 的配套代码仓库、ResearchGate，一整套学术源都在。豆包以生物通的中文解读打头，加 arXiv 和 OpenReview，纵深不如 Google。

整体测完，豆包搜索的优势集中在结构化卡片、权威分级、时效过滤和中文场景。

具体到 feature，豆包这边有几个东西是我测之前没想到会这么有用的。

第一个是结构化卡片。 汇率、股价这类查询直接返回字段，汇率卡带双向换算和更新时间，股价卡带代码、现价、涨跌额、涨跌幅、休市状态。

第二个是权威度分级。 每条结果自带一个权威度标注，可以在请求参数里设成只要"非常权威"。

第三个是时效过滤。 TimeRange 设成一天，返回的确实全是当天的。

还有 Query 改写和垂类参数，也都非常有助于提升搜索结果的质量。

额度这边，Serper 是注册送 2500 次，一次性的，用完就得买。豆包搜索是每月送 500 次，月月刷新，算下来一天十几次调用。

超出之后就需要自己购买额度了，不过跟现在大模型的价格比，搜索 API 这点钱基本可以忽略，一次搜索的成本连一轮长上下文推理的零头都不到。

豆包搜索的访问地址：https://console.volcengine.com/search-infinity/web-search-exp

PS 1：本测试是在上周六做的，请自动把「今日」这样脑补成周六。

PS 2：本次测试为完全客观的脚本测试，可以自行重复检验，另外搜索的脚本编写使用了 Doubao-Seed-Evolving 模型。
