对于实际的 Agent 开发,LLM 的数学原理之类其实不太重要,但一些参数和工作流水线还是很重要的。
Agent 落地自然要保证整个系统的稳定可观测。
传统的 RAG 是一个线性过程,对知识切片向量化,利用向量检索和 BM25 混合检索,然后返回结果。
目前的多智能体框架有三种: