联犀基础平台 / 知识库

找到资料,还能继续查证。

从图表结构保留、语义与关键词融合,到全文和关联取证,让企业资料成为自己 SaaS 中可核对的依据,而不只是一个上传文件的问答框。

WHY IT MATTERS

你的产品,为什么需要它?

企业资料散在不同文件里,直接把整份文档交给模型既难复用,也不方便核验。产品需要把资料组织、检索和原文阅读连接起来。

ENGINEERING THAT SERVES YOUR PRODUCT

先保留资料的结构,再让 AI 找到依据。

协议中的字段名、表格里的对应关系、PDF 图片中的信息,需要不同的处理。联犀把解析、检索和继续取证连接起来,让资料成为你自己产品中的知识能力。

FROM DOCUMENT TO EVIDENCE点击节点,查看技术与理由 · 流程示意

先知道内容是什么、在哪里。

统一内容元素保留文本、表格、图片和公式。结构分块保留可用的章节、页码与位置,媒体产物和生成描述分开保存。

输入
协议文件 / 图文 PDF / 办公文档
产出
结构切片 + 原始产物 + 来源定位

输入准备

先知道内容是什么、在哪里。

统一内容元素保留文本、表格、图片和公式。结构分块保留可用的章节、页码与位置,媒体产物和生成描述分开保存。

输入
协议文件 / 图文 PDF / 办公文档
产出
结构切片 + 原始产物 + 来源定位
Agent 需要继续查时搜索资料 → 阅读全文 / 查询关系

资料回答“说明怎么写”;业务工具回答“设备现在怎样”。

01

Go Docling / Python Docling · content_list

解析器可以不同,后面的处理保持一致

默认使用 Go Docling,按部署配置选择 Python 解析服务。统一内容元素承接文本、图片、表格和公式,减少下游对单一解析器输出的依赖。

选择与取舍

默认解析减少对独立 Python 服务的依赖;复杂格式、OCR 与视觉处理仍需核对文件质量和模型配置,不承诺任何文件都能正确导入。

02

结构感知分块 · 原始产物与描述分离

分块时留下章节与定位

保留可用的章节路径、页码、阅读顺序与位置;图片、表格、公式保留原始产物,另建描述供文字搜索。找到描述之后,仍能查看它对应的原内容。

选择与取舍

AI 描述不是原文。视觉模型会增加处理成本,也可能误读;不同文件格式能提供的定位信息不同。

Word 原生图表解析样本历史公众号素材中的解析器样本产物;不是客户报表,不作为问答准确率证明。
03

PostgreSQL / pgvector · 关键词查询 · RRF

语义找相近问题,关键词找准确术语

向量检索补充语义相似内容,关键词检索正文、文件名和路径,再用 RRF 融合两路排序。协议字段和设备型号不必只依赖语义接近。

选择与取舍

当前关键词路径使用 SQL 词法匹配,不是 BM25。RRF 分数不是正确率;向量索引及性能取决于维度、数据和部署配置。

04

相邻切片 · 文档与切片关系扩展

先召回,再按需要补上下文

首轮结果不足以解释问题时,补充相邻内容或直接关联资料,让被切开的说明重新连起来。关系界面可以回看两侧依据。

选择与取舍

关系扩展有触发条件,也可能带来噪声。这里是资料之间的关联,不是实体知识图谱或本体推理。

把文档关系与证据一起查看2026-09 测试环境:公开协议资料的文档关联;非客户数据。
这张界面看什么

看文档之间的关联以及对应证据,不把关系线理解成自动证明结论。

点击截图可放大查看
05

knowledge_search · 全文读取 · 切片关系查询

让 Agent 能继续查,而非只搜一次

三个工具分别承担找资料、阅读全文和查关系。Agent 可以按问题继续取证;实时设备数据则通过业务工具读取,不从旧手册猜测。

选择与取舍

工具使用和后续搜索取决于角色配置与模型判断。检索结果必须支持结论,没有资料时应说明缺项。

关系的两侧,都可以回到原文2026-09-20 测试环境:GB28181 与 RTSP/RTMP 关联证据,点击查看完整界面。
这张界面看什么

回看关联两侧的原文,检查引用是否确实支持当前问题。

点击截图可放大查看
06

来源版本 · 处理状态 · 定向重试

资料更新后,还能知道依据来自哪里

处理产物关联来源版本,可查看失败阶段并按需重试。同路径内容哈希未变化时跳过重复编译,让资料维护有可检查的过程。

选择与取舍

这是文档级处理,不代表只改一页就只处理一页,也不是完整历史版本仓库。公共库与企业自有库按各自范围使用。

测试环境实录 · 2026-09-20

从 GB28181 查到 RTSP / RTMP,再回看两侧原文

测试导入联犀公开接入文档,查看直接关联与两侧引用,核对协议配置和接入说明。界面证明取证入口可用,不代表每一条自动生成的关系都正确。

第二个实例 / 隔离测试资料

信息只在图片里,也要能回到那张原图。

2026-09-20 的隔离 PDF 测试中,型号 ZX137、端口 28830 与校验串 ORBIT-7314 只出现在嵌入图片,不在 PDF 文本层。测试记录确认:描述后检索命中 image 产物,并返回媒体引用。

这是指定资料的测试结果,不是客户项目或通用准确率。下方只解释其机制,不伪造测试响应。

  1. 图片独有内容文本层中没有对应信息
  2. 配置的视觉模型描述描述参与检索,原图仍保留
  3. 检索命中 image 产物通过媒体引用复核原图

CHOOSE BY YOUR REQUIREMENTS

选方案,看实现与交付方式。

不以单个技术名判断优劣。共同能力如实说明,重点核对你的资料、业务和运维条件。核验日期:2026-09-23。

Dify · Knowledge Pipeline

官方提供可视化知识处理流程、结构化分块、混合检索、重排与引用,并可供不同 AI 应用复用。

选型时看什么

选型时重点看可视化处理流程、应用编排与所需连接器。

查看官方说明 ↗

联犀 · 业务底座中的知识能力

默认 Go 解析、统一产物、双路检索与逐步取证工具,结合公共/企业知识、设备及业务接口交付。

选型时看什么

希望把知识能力放进自有多企业 SaaS、行业应用或设备服务时,重点评估整套接入与维护方式。

FROM CAPABILITY TO YOUR PRODUCT

怎样接进你的业务?

以下是实施路径示意,不会在官网调用业务接口或执行命令。

  1. 01

    整理可用资料

    按业务用途选择文件,明确版本与来源,检查扫描质量、表格和章节是否能正确解析。

    检查输出可阅读的文档结构与解析结果
  2. 02

    围绕问题检索

    用实际问题验证片段召回及关联上下文,而不是只看文件上传成功。

    检查输出相关片段、文档与章节来源
  3. 03

    回到原文核验

    检查引用是否支持结论;资料缺失、过期或互相冲突时交由人员处理。

    检查输出可追溯的回答依据或资料缺项