01 · 六层架构
一体机架构从用户入口到本地基础设施分层解耦。
用户入口
Web 工作台
管理后台
后续企业微信
后续钉钉
后续 OA
场景应用
体系资料问答
内审检查清单
访谈问题
审核发现草稿
整改任务建议
Harness 控制层
身份角色
权限前置过滤
RAG 编排
引用校验
拒答策略
知识数据层
原文库
资料台账
解析文本
全文索引
向量索引
模型服务层
本地 LLM
Embedding
Rerank
OCR/解析
模型网关
基础设施
AI 加速卡
CPU/内存
本地存储
备份恢复
监控日志
02 · 推荐开源/成熟组件
组件可替换,控制层必须掌握。
| 模块 | 候选组件 | 使用方式 | 注意点 |
|---|---|---|---|
| 本地大模型 | Qwen、DeepSeek Distill、GLM、InternLM | 用成熟模型,不自训基础模型 | 7B/14B 先跑通,32B 作为增强候选 |
| 推理框架 | vLLM、SGLang、Ollama、MindIE、vLLM Ascend | 根据硬件选择 | 国产算力需实测驱动、CANN、显存和吞吐 |
| Embedding | BGE-M3、bge 中文系列、Qwen Embedding | 用于向量化和语义召回 | 需评估中文制度文本效果 |
| Rerank | BGE Reranker、Qwen Reranker | 提高召回片段排序质量 | 候选数和延迟要控制 |
| 文档解析 | RAGFlow、MinerU、Docling、Apache Tika、OCR 工具 | PDF/Word/Excel/图片解析 | GB/T 19001 需 OCR 或可复制文本 |
| 向量库 | Qdrant、Milvus、pgvector | 存储片段向量 | 权限过滤不能只靠向量库默认能力 |
| 全文检索 | PostgreSQL FTS、OpenSearch、Elasticsearch | 制度条款和编号检索 | 程序编号、标题、页码要入元数据 |
| 对象存储 | 本地目录、MinIO、NAS | 原文、解析文本、导出物 | 版本和停用状态必须可追踪 |
| 后台服务 | FastAPI、Spring Boot、NestJS | 看团队栈选择 | API 要围绕资料台账和审计设计 |
| 前端 | Vue、React、Ant Design Vue/React、Element Plus | 企业后台和工作台 | 界面要工作型,不做营销页 |
03 · 自研与不自研边界
第一版要克制,不能变成无边界平台项目。
必须自研或强控制
- 资料台账:来源、版本、授权、敏感级别、生命周期。
- 权限过滤:检索前、上下文前、导出前多层控制。
- RAG 编排:召回、重排、上下文、引用、拒答。
- 审计日志:问题、角色、片段、模型、回答、测试结果。
- 标准问题验收:问题、答案、来源、角色、严重等级。
- 质量内审场景:检查清单、访谈问题、审核发现、整改草稿。
第一版不自研
- 不从零训练基础大模型。
- 不从零开发向量库和全文检索引擎。
- 不做开放应用市场和开发者生态。
- 不做多租户 SaaS。
- 不做全公司复杂系统写回。
- 不自动作正式不符合项判定或整改关闭。
04 · 数据对象模型
开发同事后续可以从这些对象开始建表或建接口。
| 对象 | 关键字段 | 说明 |
|---|---|---|
| Document | 文件名、版本、来源、负责人、授权、状态、敏感级别 | 资料台账核心对象 |
| Chunk | 文档 ID、页码、章节、片段文本、权限标签、向量 ID | 检索和引用的最小单元 |
| Role | 角色名、部门、知识域权限、导出权限 | 权限矩阵基础 |
| Question | 标准问题、类型、测试角色、严重等级、期望行为 | 验收问题对象 |
| GroundTruth | 标准答案、必须引用来源、通过条件 | 验收依据 |
| AuditLog | 用户、问题、召回、过滤、上下文、引用、模型、回答 | 审计和复盘依据 |
| Feedback | 错误类型、原因、修复建议、复测结果 | 持续纠错闭环 |