返回项目库
企业数据整理与 AI 应用引擎
Hermes Notebook
把散落在 PDF、Word、Excel、PPT、图片、本地文件夹和业务网页中的企业资料,整理成带来源、可检索的知识。企业可以通过 API 在这些数据上开发客服机器人、内部知识问答和业务助手。
可部署系统|让企业资料可被 AI 检索和引用
- 企业真正有价值的数据散落在文件夹、Office 文档、PDF、图片和业务网页里。员工查找困难,不同 AI 应用又要重复整理同一批资料
- Hermes 导入多种格式的资料,恢复文档结构,建立可追溯的知识节点和检索索引,再通过受权限限制的问答与检索接口向上层应用提供证据
- 客户得到一套由自己控制的企业知识引擎。客服机器人、内部问答和后续业务助手可以复用同一份整理好的企业数据,不必为每个 AI 应用重新清洗和导入资料
项目目前支持 Docker Compose 本地部署,已具备文件、文件夹和 URL 导入,多格式资料整理,可追溯检索,带引用问答,以及受 Token 和知识库范围限制的检索与问答 API。
原来的流程
- 企业资料分散在本地文件夹、PDF、Word、Excel、PPT、图片和业务网页中,由不同部门和员工分别保管。
- 员工遇到问题时依靠文件名、目录和个人经验查找资料,再手工确认答案来自哪一份文档。
- 每开发一个客服机器人或内部助手,都要重新收集、清洗和导入相似资料,应用之间难以共用整理成果。
系统接管什么
- 按文件格式提取正文、标题、表格和图片文字,并保留每段内容与原始资料位置的关系。
- 把整理后的内容写入对应知识库,建立可检索的知识节点、来源记录和完整度状态。
- 外部应用查询时,系统先校验 Token、接口权限和知识库范围,再返回证据片段或基于这些证据生成带引用答案。
人工保留什么
- 管理员决定哪些文件夹和资料可以进入哪个知识库,并检查导入失败、重复文件和资料完整度。
- 业务负责人确认检索结果和引用是否足以支持回答,再决定哪些知识库可以提供给具体应用。
- 客服话术、对外回复和需要执行的业务动作继续由对应应用和人员审核。
最终交付什么
- 按业务主题整理的企业知识库,包含来源、原文位置、完整度和处理记录
- 供应用直接调用的证据检索结果,以及带来源引用的知识问答
- 面向客服机器人、内部知识问答和其他业务助手的检索与问答 API
使用范围
- Hermes 提供企业知识整理和检索内核;客服机器人、企业微信或飞书接入、界面和业务动作需要由上层应用完成。
- 原始资料缺失、过期或扫描质量过低时,系统无法凭空补齐事实,需要企业先修正资料来源。
- 企业群聊和部门身份不能只依赖模型判断,必须由接入层明确映射到允许访问的知识库。
你的业务不需要复制这个项目;我们会从实际流程重新诊断。
讨论你的流程