SERP 返回 JSON 体积横评:喂 LLM 谁更省 token

[复制链接]
发表于 2026-8-17 09:31:22 | 显示全部楼层 |阅读模式

马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。

您需要 登录 才可以下载或查看,没有账号?立即注册

×
做 AI grounding,把 SERP 结果喂给 LLM,token 成本是大头。同一批 query,各家返回的 JSON 体积差很多,直接影响 token 花销。
这篇对比几类常见 SERP API 服务的响应体积。以下用"常见 SERP API 服务"泛指。
为什么体积重要


  • token 成本:JSON 越大,喂 LLM 的 token 越多
  • 解析时间:大 JSON 解析慢
  • 存储:存历史时占空间
响应体积对比

服务单次体积字段数冗余度服务 A大多高服务 B中中中serpbase精简焦点字段低serpbase 的 organic 结果只带焦点字段(rank/title/link/snippet),喂 LLM 省 token。
关键:喂 LLM 前必须裁剪

不管哪家,整包喂都是浪费。裁剪成三样:
  1. def slim_results(organic, limit=5):
  2.     return [
  3.         {
  4.             "title": i.get("title", ""),
  5.             "snippet": (i.get("snippet") or "")[:80],
  6.             "link": i.get("link", i.get("url", "")),
  7.         }
  8.         for i in organic[:limit]
  9.     ]
复制代码
裁剪前后对比

指标原始裁剪后单次 token几千~600月成本(1000 次)高降 90%答案质量-几乎不掉token 成本换算

按输入 $2.5/1M token:

  • 原始 7k token/次:1000 次 ≈ $17.5
  • 裁剪 600 token/次:1000 次 ≈ $1.5
裁剪后省 90% 左右。
serpbase 本身精简

serpbase 的 organic 字段不多,而且返回前就该裁剪。它响应体积本来小,裁剪后更省。
  1. data = search("装修公司")
  2. # organic 每条:rank, title, link, snippet
  3. # 没有 sitelinks/icon 等冗余
复制代码
怎么判断体积
  1. import sys
  2. def size_kb(data):
  3.     return sys.getsizeof(str(data)) / 1024
复制代码
用真实关键词测各家的单次体积,再决定裁剪策略。
注意


  • 裁剪要够:只留 title/snippet/link,别留多余字段
  • snippet 截 80 字符:够 LLM 用了
  • 图片/新闻端点:2 积分,喂 LLM 前同样裁剪
选型发起


  • AI grounding:优先体积小的服务
  • 批量:裁剪后都差不多,原始小的更省
  • 混合:响应体积 + 单价一起看
完整参数和响应字段参考:serpbase.dev/docs。JSON 体积,喂 LLM 前先裁剪,谁都能省 90%。
回复

使用道具 举报

登录后关闭弹窗

登录参与点评抽奖  加入IT实名职场社区
去登录
快速回复 返回顶部 返回列表