架构概述
OpenViking 是为 AI Agent 设计的上下文数据库,将所有上下文(Memory、Resource、Skill)统一抽象为目录结构,支持语义检索和渐进式内容加载。
系统概览
核心模块
| 模块 | 职责 | 关键能力 |
|---|---|---|
| Client | 统一入口 | 提供所有操作接口,委托给 Service 层 |
| Service | 业务逻辑 | FSService、SearchService、SessionService、ResourceService、PackService、DebugService |
| Retrieve | 上下文检索 | 意图分析(IntentAnalyzer)、层级检索(HierarchicalRetriever)、Rerank 精排 |
| Session | 会话管理 | 消息记录、使用追踪、会话压缩、记忆提交 |
| Parse | 上下文提取 | 文档解析(PDF/MD/HTML)、树构建(TreeBuilder)、异步语义生成 |
| Compressor | 记忆压缩 | Schema 驱动的记忆提取、LLM 去重决策 |
| Storage | 存储层 | VikingFS 虚拟文件系统、向量索引、AGFS 集成 |
Service 层
Service 层将业务逻辑与传输层解耦,便于 HTTP Server 和 CLI 复用:
| Service | 职责 | 主要方法 |
|---|---|---|
| FSService | 文件系统操作 | ls, mkdir, rm, mv, tree, stat, read, abstract, overview, grep, glob |
| SearchService | 语义搜索 | search, find |
| SessionService | 会话管理 | session, sessions, commit, delete |
| ResourceService | 资源导入 | add_resource, add_skill, wait_processed |
| PackService | 导入导出、备份恢复 | export_ovpack, import_ovpack, backup_ovpack, restore_ovpack |
| DebugService | 调试服务 | observer (ObserverService) |
双层存储
OpenViking 采用双层存储架构,实现内容与索引分离(详见 存储架构):
| 存储层 | 职责 | 内容 |
|---|---|---|
| AGFS | 内容存储 | L0/L1/L2 完整内容、多媒体文件、关联关系 |
| 向量库 | 索引存储 | URI、向量、元数据(不存储文件内容) |
数据流概览
添加上下文
Parser:解析文档,创建文件和目录结构(无 LLM 调用)
TreeBuilder:移动临时目录到 AGFS,入队语义处理
SemanticQueue:异步自底向上生成 L0/L1
向量库:建立索引用于语义搜索
检索上下文
意图分析:分析查询意图,生成 0-5 个类型化查询
层级检索:目录级递归搜索,使用优先队列
Rerank:标量过滤 + 模型重排
结果:返回按相关性排序的上下文
会话提交
消息:累积对话消息和使用记录
压缩:保留最近 N 轮,旧消息归档
归档:生成历史片段的 L0/L1
记忆提取:根据记忆策略和 MemoryType Schema 从消息中提取记忆
存储:写入 AGFS + 向量库
部署模式
HTTP 模式
用于团队共享、生产环境和跨语言集成:
Server 作为独立进程运行(
openviking-server)客户端通过 HTTP API 连接
支持任何能发起 HTTP 请求的语言
参见 服务部署 了解配置方法
设计原则
| 原则 | 说明 |
|---|---|
| 存储层纯粹 | 存储层只做 AGFS 操作和基础向量搜索,Rerank 在检索层完成 |
| 三层信息 | L0/L1/L2 实现渐进式详情加载,节省 Token 消耗 |
| 两阶段检索 | 向量搜索召回候选 + Rerank 精排提高准确性 |
| 单一数据源 | 所有内容从 AGFS 读取,向量库仅存储引用和索引 |
相关文档
OpenViking 核心原理
/
01-架构概述
0 字
0 行