跳到主要内容
PRODUCT PLATFORM

从文档结构化理解
企业知识运营闭环

一套平台连接文档解析、RAG 检索、Deep Agent 与 LLM Wiki,
让知识既能准确回答,也能交付台账和报告,并在权限边界内持续运营

结构化 RAG
知识执行
知识图谱
运营闭环

所有功能明细

按业务环节汇总当前产品能力,具体配置和使用方式可继续查看对应文档

功能分类功能模块功能说明使用文档
文档解析与分块8多格式文档处理支持 PDF、Word、Excel、PPT、Markdown、图片和视频等企业常见资料,解析任务异步执行。查看文档
MinerU / PaddleOCR解析扫描件、复杂版式、表格、公式和图片,保留标题、页码与原文坐标。查看文档
MinerU-Popo 结构增强可选增强标题层级、章节关系、跨页表格和图片上下文,失败时自动回退到原始 MinerU 结果。查看文档
五种分块策略提供 Smart、Title、Regex、Parent-Child 和 Page 分块,按文档结构与检索目标选择。查看文档
父子分块以小块完成精准命中,再返回更完整的父级上下文,并支持父子关系维护。查看文档
复杂表格处理保留超长表格、合并单元格、重复表头、上下文行和跨页连续关系。查看文档
图片与视频理解提取文档图片、图注和上下文;视频支持 ASR、关键帧、VLM 描述、时间戳引用与检索。查看文档
解析预览与重跑在线查看分块和原文位置,调整解析或分块配置后可重新执行处理任务。查看文档
检索与知识问答9关键词与向量混合检索组合词法召回、向量召回、权重信号和可选 Rerank,覆盖常规企业问答。查看文档
同义词与元数据过滤通过知识库词典扩展业务术语,并按文档元数据、知识库或指定文档收敛检索范围。查看文档
检索测试与调试查看粗排、精排、关键词、相似度及不同检索路径的命中信息,便于定位效果问题。查看文档
DeepRead 深度阅读围绕文档目录、相关正文与完整章节多步阅读,生成带原文引用的回答。查看文档
ColPali 视觉融合检索视觉文档与普通文档分路召回,以 RRF 合并排名,适合图表、PPT、扫描件和版式内容。查看文档
SAG 多跳检索面向跨文档事实组合和关系推理逐步查证;无结果或服务异常时回退标准检索。查看文档
RAPTOR / GraphRAG通过摘要树和知识图谱补充全局主题、实体关系与长文档层级信息。查看文档
可追溯引用回答引用可回到原文页码、坐标和图片位置,支持 PDF 预览与高亮核验。查看文档
联网搜索补充可配置博查联网搜索,在企业知识不足时补充公开网络材料。查看文档
Deep Agent 与成果交付8统一回答方式每轮可选择普通问答、智能处理、深度阅读、结构化抽取或报告生成,不改写会话全局配置。查看文档
@文档精确选材从已授权知识库中点名本轮材料,普通问答与专业能力使用同一范围边界。查看文档
跨章节深度阅读浏览文档结构、检索正文并按节点读取上下文,适合制度解释、技术核对和跨文档比较。查看文档
编号条款分析对中文“第 X 条”执行完整计数、最大编号、连续性、缺号和重复编号检查。查看文档
结构化数据抽取按用户字段从一份或多份完整文档提取记录,区分可靠值、缺失值和歧义值。查看文档
表格与 Excel 交付把已经核验的二维记录生成可下载台账,保留每条记录的文档身份和来源。查看文档
人工补充与任务恢复关键口径无法确定时暂停任务,收到用户补充后从当前阶段继续,不重复已完成工作。查看文档
报告与文章生成依据指定材料生成报告、方案、讲稿或文章,支持章节化流式写作、图片引用和 Markdown 下载。查看文档
LLM Wiki 知识网络5知识库自动成 Wiki从知识库材料生成实体页、概念页和摘要页,把文档集合组织为可浏览的知识网络。查看文档
全文搜索按关键词检索 Wiki 页面、企业实体和专业概念,不必从聊天入口逐个提问。查看文档
跨页面链接自动建立相关页面之间的可读链接,支持沿概念与上下游关系继续探索。查看文档
关系图谱以图形展示实体与页面关系,并保留关联材料与来源引用。查看文档
增量维护与健康检查文档新增、删除或更新后维护相关页面,支持生成状态、异常检查与恢复。查看文档
知识管理与运营8知识库目录树使用多级文件夹管理大量知识库,支持创建、移动、重命名和按目录浏览。查看文档
知识库导入导出支持知识库跨环境迁移、离线交付和批量治理,减少重复解析与重建成本。查看文档
统一文件管理集中查看、上传、下载、移动和管理文件,并按权限控制可见与可操作范围。查看文档
运营数据概览按知识库、问答、检索命中、用户和时间查看使用情况,并按当前权限过滤数据。查看文档
知识缺口与反馈聚合未命中、低质量回答和用户反馈,把真实使用问题转成待优化事项。查看文档
AI 辅助诊断结合问答反馈与检索证据分析原因,支持单条和批量诊断并形成优化建议。查看文档
任务与运营报表跟踪后台任务状态,按当前筛选范围导出运营明细与阶段报表。查看文档
用户模型配置管理员按用户配置默认模型与可用范围,统一校验授权并同步模型凭据。查看文档
组织、权限与身份8用户与多级组织维护用户、集团、部门和下级组织,支持主组织、组织成员与组织管理员。查看文档
协作组为跨部门项目建立横向协作主体,独立维护成员并参与知识库授权。查看文档
纯 RBAC 授权面向用户、组织和协作组授予查看、编辑或管理权限,不以租户字段替代资源授权。查看文档
目录权限继承上级文件夹授权向下作用于子目录和知识库,多来源授权按最高有效权限合并。查看文档
组织管理员边界组织管理员只管理授权组织与资源子树,列表、检索、运营和导出使用同一权限范围。查看文档
企业微信登录与组织同步支持浏览器扫码和企业微信工作台登录,首次登录可完成账号映射与组织同步。查看文档
外部 OAuth2 / OIDC支持对接企业身份源与 Keycloak OIDC,完成授权码交换、会话与账号信息映射。查看文档
分享访问控制分享对话可要求登录,并按访问者本人的 RBAC 权限限制可用知识范围。查看文档
业务接入与开放能力7企业微信智能机器人把知识问答接入企业微信会话,支持企业内部工作入口和图文回复。查看文档
钉钉机器人配置钉钉应用、机器人权限和回调,在钉钉内使用 KnowFlow 问答。查看文档
飞书机器人通过飞书应用与机器人权限配置,把知识库能力接入飞书会话。查看文档
Dify 接入支持外部知识库 API、插件与工作流方式接入,并返回可追溯引用。查看文档
MaxKB 接入通过 API 工具和高级编排把 KnowFlow 检索能力接入 MaxKB 工作流。查看文档
REST API 与 SDK通过标准接口和 SDK 对接内部系统、自动化流程及自建 Agent 应用。查看文档
分享与嵌入对话提供独立分享页面、全屏嵌入和网页挂件预览,便于接入现有门户。查看文档
私有化部署与基础设施8Docker Compose 部署提供完整容器编排与环境变量配置,支持基础服务和可选能力按需启用。查看文档
Kubernetes / Helm支持分布式任务执行、多副本与服务拆分,适配企业集群和高可用部署。查看文档
多种元数据数据库支持 PostgreSQL 与 MySQL,并提供 MySQL 到 PostgreSQL 的迁移工具。查看文档
多种文档引擎支持 Milvus、Elasticsearch 和 Infinity,按数据规模、检索方式与运维条件选择。查看文档
对象存储选择支持 MinIO 与 RustFS,满足私有化文件、解析产物和图片资源存储。查看文档
离线环境支持离线镜像、模型和知识库交付,数据与模型可以完全留在企业网络内。查看文档
可选增强服务SAG、ColPali、MinerU-Popo 等能力独立部署,基础环境无需承担全部 GPU 与服务开销。查看文档
运行诊断提供服务健康检查、任务队列和实际运行引擎信息,便于管理员定位部署问题。查看文档

部分能力需要独立服务、特定模型或可选部署组件,实际可用范围以对应文档和部署配置为准。

七大产品能力

从知识进入系统、被检索和连接,到被治理和持续优化

01

以文档结构为核心的传统 RAG

不是先切碎文本,而是先理解文档

KnowFlow 保留标题层级、段落关系、表格、公式、图片和版面位置,再按不同文档结构选择合适的知识单元,为稳定检索提供可追溯基础。

复杂文档解析MinerU 3.x、PaddleOCR 处理 PDF、扫描件、表格和公式
结构化分块Smart、Title、Regex、Parent-Child、Page 多种策略
父子上下文用子块精准命中,用父块补充完整语义
原文追溯分块、引用和图片可回到文档原始位置
检索质量的上限,首先由知识进入系统时是否保留结构决定
02

传统 RAG、SAG 与视觉检索协同

让不同复杂度的问题走合适的检索路径

常规问题使用成熟的关键词与向量混合检索;复杂问题由 SAG 做跨文档、多步骤检索;图表和版式内容由 ColPali 视觉路补充。

传统混合检索融合词法、向量、权重和可选 Rerank,覆盖高频问答
SAG 多跳检索面向跨文档事实组合和复杂关系问题逐步查证
失败自动回退SAG 无结果或异常时自动回到标准检索链路
ColPali 视觉融合文本与视觉文档分路召回,再通过 RRF 合并排名
不是所有问题都需要最重的推理,但复杂问题必须有更深的路径
03

Deep Agent 企业知识执行

不止回答问题,还能交付台账和正式稿件

Deep Agent 在用户已授权的知识范围内完成多步阅读、字段抽取和材料写作,把企业文档转成可核验、可下载、可继续编辑的工作成果。

深度阅读浏览目录、检索正文并跨章节核对,回答保留原文引用
结构化抽取按字段批量处理多份文档,可交付 Excel 台账
报告生成依据指定材料流式撰写报告、文章、方案和讲稿
精确任务范围通过回答方式与 @文档 控制当前轮次,不扩大授权边界
企业知识的价值不只在于被找到,更在于变成可以继续使用的工作成果
04

LLM Wiki 企业知识图谱

从文档集合升级为可探索的知识网络

LLM Wiki 自动从知识库生成结构化百科,将实体、概念、页面、关系和来源组织起来,让用户既能问,也能搜、能看、能沿关系探索。

自动生成 Wiki从知识库提炼主题、实体、概念和结构化页面
全文搜索直接查找企业实体、产品、项目和专业概念
跨页面关联用可读链接连接相关页面和上下游知识
关系图谱可视化实体之间的关系,并保留来源引用
问答解决一个问题,知识图谱帮助人建立完整认知
05

企业知识运营闭环

从“知识已经入库”走向“知识持续变好”

把真实问答、检索命中和用户反馈转成可观察的运营指标与知识缺口,再通过 AI 诊断、优化任务和报表复盘持续改善知识质量。

运营概览查看问答量、活跃用户、有效率、反馈和使用趋势
知识缺口聚合未命中、低质量和反复出现的相近问题
AI 辅助诊断结合问答反馈与检索证据生成可执行优化建议
任务与报表批量处理优化任务,导出运营明细和阶段报表
知识库不是上线即完成,而是需要基于真实使用持续运营
06

企业组织与知识库树

让知识结构与企业管理结构保持一致

建立多层级组织、成员和协作组,再通过树状目录组织大量知识库,明确知识归属、业务边界和维护责任。

多层级组织按集团、部门和团队建立真实组织关系
成员与协作组兼容纵向组织和跨部门项目协作
知识库目录树用多级文件夹分类、移动和归档知识库
统一维护支持目录规划、知识库导入导出和批量治理
知识规模扩大后,清晰的归属和目录比更多搜索框更重要
07

目录级纯 RBAC 权限治理

把正确的知识交给正确的人

任意知识目录或知识库都可以授权给指定用户、组织或协作组。权限沿目录向下继承,多来源授权取最高权限,并贯穿检索、管理与运营数据。

任意主体授权支持用户、组织、协作组三类授权主体
三级权限分别授予查看、编辑和管理能力
目录继承上级目录授权自动作用于子目录和知识库
统一权限边界知识列表、检索、运营明细和导出使用同一 RBAC 范围
三方协同接入支持企业微信、钉钉、飞书等企业工作入口
权限不是外围配置,而是企业知识被管理和使用的基础边界

能力矩阵

覆盖解析、检索、知识网络、运营、治理与私有化基础设施

文档处理

MinerU 3.xPaddleOCRSmartTitleRegexParent-ChildPage

检索引擎

混合检索RerankSAGColPaliRRFDeepRead

知识网络

LLM Wiki全文搜索跨页面链接关系图谱来源引用

知识运营

运营概览知识缺口AI 诊断任务队列XLSX / CSV

治理能力

组织架构协作组知识库树目录继承纯 RBAC

业务接入

企业微信钉钉飞书DifyRESTful APISDK

基础设施

PostgreSQLMilvusRustFS / MinIODocker ComposeKubernetes

不只是另一个 RAG 问答工具

KnowFlow 与传统文档问答方案的差异

对比维度KnowFlow传统方案
知识单元保留标题、父子层级、表格、图片和版面结构固定长度切分,结构与上下文容易丢失
检索路径传统混合检索、SAG 多跳检索、ColPali 视觉检索协同所有问题共用一条向量检索链路
知识形态问答之外生成可搜索、可浏览的 LLM Wiki 知识图谱知识停留在文档列表和聊天窗口
持续运营指标、知识缺口、AI 诊断、优化任务和报表形成闭环上线后缺少质量反馈和改进抓手
知识组织企业组织与知识库树共同管理归属和业务边界知识库平铺,规模扩大后难以维护
权限治理目录或知识库可授权给用户、组织、协作组并向下继承通常只支持单库或简单成员权限
部署与数据支持私有化和离线部署,数据与模型由企业控制依赖外部云服务,数据边界受平台限制

典型应用场景

从精准问答到复杂研究,再到集团级知识治理

制度、合同与技术资料

保留章节、条款、表格与上下文,用结构化 RAG 提供稳定、准确、可回溯的知识问答。

结构化解析父子分块原文引用

复杂研究与多跳问答

使用 SAG 跨文档检索和逐步查证,处理需要组合多个事实或追踪复杂关系的问题。

SAG多步检索自动回退

企业百科与知识网络

用 LLM Wiki 自动沉淀企业实体、概念与关系,形成可搜索、可浏览、可探索的知识图谱。

LLM Wiki全文搜索关系图谱

集团与多部门知识治理

用组织、知识库树和目录级 RBAC 管理复杂知识边界,并通过运营闭环持续改善知识质量。

组织架构目录授权知识运营

用真实企业知识体系验证 KnowFlow

带上文档、典型问题、组织结构和权限规则,一起评估完整知识闭环