一个把 RAG 分成 5 个阶段,从最简单 Demo 进化到企业级 / 科研级系统的开源项目:UltimateRAG

项目地址:


运行截图:

我在做一个 RAG 开源项目,目标很明确:

把 RAG 拆成 5 个清晰阶段,从“能跑的 Demo”,一步步演进到工程可用、甚至具备科研价值的系统。

不是堆功能,也不是概念展示,而是按真实工程节奏推进。


五个阶段的设计思路

  • Stage 1:Naive RAG
    最小可用闭环:文档 → 分块 → 向量检索 → 问答
    解决“到底在跑什么”
  • Stage 2:Advanced RAG
    语义分块、混合检索、重排序、路由
    解决“为什么效果不稳定”
  • Stage 3:Agentic RAG
    多步推理、工具调用、自反思
    解决“复杂问题怎么拆解”
  • Stage 4:GraphRAG / Fine-tuning
    结构化知识、关系推理、模型适配
    开始接近科研与复杂业务场景
  • Stage 5:RAGOps
    评测、回归、监控、持续优化
    面向长期运行的系统

每一阶段都是可运行、可单独理解、可继续扩展的。


项目定位

UltimateRAG 更像一条学习与工程并行的路线图:

  • 你可以只停在某一阶段
  • 也可以沿着路线一直往下走
  • 所有代码都围绕“为什么这样设计”展开

如果你正在做或准备做 RAG

  • 有工程背景
  • 不满足于复制 Demo
  • 想真正理解 RAG 的演进逻辑

这个项目可能对你有价值。


如果你认可这个方向

  • 给项目一个 Star
  • 提 Issue / PR
  • 或者一起讨论下一阶段该怎么设计
66 个赞

666,遇见rag大佬了,前排支持

我是认为,一力降十会

1 个赞

怎么解决概括性问题以及索引的问题呢

这里有一个更加清晰的 RAG 仓库 :distorted_face:

9 个赞

6666,很强收藏了

服务器2h2g跑大约万字级别的文档rag,会很慢吗?
只需要最简单的api即可

之前尝试研究过opennotebook和dify,内存太少跑不动

1 个赞

HyDE

1 个赞

挺好!!!!

支持一下,已star

2 个赞

太强了,大佬

可以考虑用我开源的 highkay/stupidsimplerag: 简单,低开销,适合金融事件和信息的rag

3 个赞

先收藏。

贡献star

1 个赞

点赞,收藏。

强啊!学习了

碰到rag 大佬了

真愁着找不到入门项目,太感谢了

学习一波

大佬厉害,正在寻找rag的工程教程,你这也太适合了