Langhuan 把模型连接与模型能力拆开管理,支持不同 Provider 提供 embedding、rerank 等能力,并在混合召回之后执行重排。检索不再绑定单一模型或单一供应商,连接配置也不再决定业务代码的写法。
一个 Provider,多种能力
同一个模型服务可能同时提供 embedding、rerank 或未来的其他能力。这一版本把“连接到哪里”和“连接能做什么”分开:
- 模型目录展示 provider 实际提供的能力,而不是只展示一个连接名称。
- 运行时根据已注册能力构造 provider 描述符,缺少能力时尽早报出稳定错误。
- 连接与模型配置保存快照,后续配置变化不会悄悄改变已经创建的知识库行为。
混合召回之后再判断一次
向量召回和 PostgreSQL 全文检索适合快速扩大候选集合,重排则负责在候选集合中重新判断语义相关性。现在的检索路径可以表达为:
vector + full-text → RRF hybrid recall → rerank → parent context
重排模型的生命周期、配置和连接管理都可以在 Web Console 中完成,搜索 API 与 MCP 工具共享相同的策略合同。
更容易定位结果差异
检索阶段会记录结构化的重排与召回事件,帮助开发者区分“没有召回到”和“召回后被重排掉”这两类问题。对调试 RAG 来说,这比只看到最终答案更有用。