原件归档、解析状态、附件路径、去重校验。
系统总览
以最小 pipeline 为主线,串起文件、解析、数据库、API、RAG 和反馈沉淀。
MySQL 8.0 可承载文档、任务、知识、记忆与审计。
上传、解析、Review、发布、检索、候选提取与审核。
固定问题验证知识是否真正可召回。
最小 Pipeline
系统边界
文件登记、Markdown 提取、人工 Review、知识单元、基础检索、问题测试。
文件存储、元数据表、任务表、知识单元表、索引表、API 调用记录。
复杂 Memory 框架、知识图谱、多 Agent 协同、自动反思和高级权限。
RAG 知识库与对话记忆边界
默认隔离存放正式文档、结构化表格、知识单元和可引用来源,服务被授权的 Agent 和用户。
存放用户偏好、历史问题、纠错记录和个人上下文,默认只服务当前用户。
对话中有业务价值的内容先进入候选池,脱敏、审核、授权后才允许沉淀为组织知识。
选择演示身份
同一个持续对话 Agent 会根据身份切换业务上下文:农技员负责地块与农户服务闭环,专家负责被指派咨询、共享资料研判和知识共建。
农技员工作台
管辖地块负责地块巡查、农户咨询、AI 预警初审、向专家发起复杂咨询。
农户上传叶片照片,已关联地块、天气、近期用药记录。
缺少土壤检测与前次施肥量,适合先追问再给建议。
专家工作台
被指派 + 公开知识处理农技员升级咨询,仅查看被授权共享地块,维护知识库和品种库。
可查看地块档案、农事日志、照片和报告;不可查看农户全量数据。
补充适宜区域、抗黑穗病表现、宿根能力和来源依据。
一期:专家服务闭环
咨询详情 / 共享地块只读
未选择二期:专家知识沉淀
咨询记录 → 候选 → 知识库身份边界
原生模型 vs 前处理增强
原生推理模型
不接 RAG查网页
enable_search本地 RAG
Preprocess + Local网页 + 本地 RAG
Web + Local前处理路由计划
命中知识 / 记忆候选
真实种植问题场景评测
用于观察系统能否识别选种、施肥、病虫害、田间操作、多模态输入、表达错误和高风险问题。
测试问题池
评测结果
问题前处理
结构化输出
Model API文件资产管理
对象存储与目录
MySQL 接入状态
本机 MySQL80 Runningmysql -u root -p < db/schema.sql cd backend copy .env.example .env npm install npm start
核心数据表
示例记录
API 调用台
请求 / 响应
源文件包
原始文档查看
解析 Markdown
Review 工作台
知识单元
RAG 检索测试
表格识别
图片识别
地点定位
天气查询
管辖地块内服务农户,可向专家发起咨询并授权共享资料。
持续对话 Agent
查看本轮前处理、RAG 命中与记忆同步
用户私有 Memory Store
记忆候选审核池
隐私与安全策略
对话日志和用户记忆默认只对当前用户可见。
每次召回都带 user_id、project_id、agent_id。
手机号、账号、个人偏好等不能直接进入组织知识。
记忆读写、删除、沉淀都写入 audit_logs。
竞品映射
V1 容易实现的需求
登记源文件,生成 Markdown、表格 JSON、图片说明和页码引用,再通过 Review 状态控制是否发布。
把可检索内容拆成知识单元,保留来源文件、页码、表格引用、标签、状态和版本。
用原生模型、联网、本地 RAG、联网 + 本地 RAG 四种模式对比,专门暴露幻觉与证据缺口。
对话中的偏好、纠错、常用地点先作为个人记忆候选,审核后才允许升级为组织知识。
V1 / V2 边界
先做可演示闭环文件登记、解析产物 Review、知识单元发布、表格单独结构化、持续对话 Agent、位置/天气/图片工具、四路问答对比。
复杂 PDF/OCR 先接第三方或模型能力;权限先用 user_id/project_id 隔离;Review 用状态字段表达,不单独做目录层。
知识图谱、自动知识融合、多 Agent 协作、复杂账号权限、记忆自动反思、跨用户组织知识沉淀。
完整需求文档:DEMO_REQUIREMENTS_V1.md