[开源求star] SearchBoost v0.2,面向多Agent的搜索增强工具🚀

本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:

  • 我的帖子已经打上 开源推广 标签: 是
  • 我的开源项目完整开源,无未开源部分: 是
  • 我的开源项目已链接认可 LINUX DO 社区: 是
  • 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是
  • 以上选择我承诺是永久有效的,接受社区和佬友监督: 是

以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出


距离上次更新已经过去了一个月,我平常用着v0.1版本感觉还凑合,结果一看npm,好嘛,3K下载量。为了不辜负各位佬友,我就爆肝了几天,把Search Boost给重新审了并更新一个大版本。

首先给不了解的佬友介绍一下我的项目:
Search Boost是一款网络增强插件,采用多引擎聚合的方式来提高搜索质量,同时为了提高实时性,原生支持X搜索。详情:[开源推广] search-boost:让模型拥有更强的搜索能力,还可以让模型抓取x的页面而不需要x官方订阅和api

新版亮点是什么?

:bullseye:主动式搜索优化:

  • 为MCP接入的agent写了hook,在agent启动时输入短的提示词,agent现在会更加主动的搜索。Pi和DSH优化了注入提示词。

:magnifying_glass_tilted_left:fused_search多引擎并行搜索工具更新:

  • 引擎池重做:v0.1版本的api/free两层感觉并不能适配所有任务,比如如果想用exa多搜索专业知识就做不到。所以这一次,我重写了引擎池,为多种任务设置自己的引擎层,写了各个引擎的占比比重,同时开放给agent权限让agent可以自由选择使用引擎和权重来进行搜索,当然agent也可以自由选择使用什么层。(具体权重见仓库README)

  • 增加x搜索:当agent判断用户问的问题偏向于实时时,可传入community参数,使得搜索结果聚合x的及时性。

:page_facing_up:fetch_page网页抓取工具更新:

  • 效率与效果的综合更新:
    我重新确定了fetch_page工具的位置:当agent需要抓取某个网页时,不应该自己写curl和自己理解网页中有效的信息是什么。所以我写了网络优化抓取(速度提升)和后处理(处理噪声),实测确实极大的提升了agent搜索网页的能力。

:robot:subagent并行研究工作流:

  • 重做了Pi和dsh的子代理插件,现在子代理默认获得Search Boost工具,并写了fast和complex两种模式,面向不同复杂度的搜索场景。
  • 对于MCP接入的agent,我写了相关skill,但是还是实验版本,还不确定性能如何。

:test_tube:增加Jev工具:adaptive_search(实验性功能)

  • 现在,佬友们可以将Jev接入Search Boost中,让其实现自动化搜索
  • Jev将接管引擎选择和最终网页评分,并判断是否有缺口,当概率较高时,系统自动开启新一轮的搜索,直到判断成功。从而实现自动化搜索。
  • 目前此功能为实验性,较多不确定性。但确实已经可以使用了。

快速开始(30s):

# 新用户、pi、dsh
npm install -g search-boost
# 启动TUI自动化配置
search-boost
# mcp版老用户更新:
npx --yes --package=search-boost@latest -- search-boost migrate -y

碎碎念

我从没有想到,有一天自己的想法能获得那么多人的认可,感谢各位佬友的支持,我会一直将这个项目更新下去的。

佬友们如果有什么问题,欢迎推issue给我,或者直接评论区也可以,我看到后会立刻去修复的。

求star​:glowing_star:,求star​:glowing_star:
GitHub地址:

21 个赞

codex也可以用么,然后对于调研结果的处理,即突出重点,忽略不重要信息和提出矛盾点,是依赖skill还是模型本身能力呀

1 个赞

codex是可以用的。当前的话,对于调研结果的处理,还是更依赖于模型能力一点。现在我只能说搜到的内容更加高质量,及时性更强。

不过现在我还在实验一个新功能,我在试着将内容的挑选的事情交给jev来做。我加了个新的工具:adaptive,agent只需向工具输入待询问列表,关键词和调研方向,然后让jev来识别并结合算法判别,如果认为当前价值还不够高,系统将自动开启下一轮,直到符合预期就返回有价值的url和摘要给agent。后续可能也会支持普通LLM模型来,但估计速度成本还是不如jev。
v0.2.2版本还有很多问题,算法,成本等都有很大的缺陷。v0.2.3版本我刚更新出来还在测试,如果佬想用的话现在npm可以直接下(不过可能有bug)。或者等两天我测试完了会在L站发更新日志。

佬如果还有什么问题,随时问我,我看到就会立刻回

好东西!刚好能用到!

2 个赞

感谢大佬认可~
大佬要是有什么问题可以随时找我,我看到就会立刻回复的

翻了上个帖子哦,有人已经提到了站内的公益搜索站,【Searchix】公益 Tavily/Serper API,让 Agent 真正用上全网搜索
目前适配如何啦,然后好奇不用grok的订阅,用佬自己开发的x搜索,在速度和token用量上,表现如何呀

2 个赞

v0.2.3版本所有的搜索引擎都已经支持使用自定义的baseurl了。等我测试完,把发现的bug修完就在站内放更新日志。
x搜索上的话,官方的搜索更快一些,质量和数量上会好一些,毕竟我的方案主要是做固定抓取通道加尽力模仿官方工具效果的后处理。不过我用着感觉也没差太多。佬可以试试。
x的token用量上的话,正常agent也就搜个1-2轮就得到他想要的结果了,所以token用量很少。

测试如何啦,一直没看见佬更新帖子欸,我还发现了一个agent reach工具,佬觉得有必要参考参考,增强这个搜索工具么

1 个赞

修着修着发现个新设计就去把adaptive重做了 :melting_face:,预计今明两天就能上线新版本
ok我去看看参考一下
谢谢佬的反馈

2 个赞