之前做了一个解析+记忆的小工具 Knowhere ,很多人都觉得跟 MinerU 有点像,其实 MinerU 只负责解析,Knowhere 还会把解析之后的 chunking 、embedding 一系列事情都做了,直接变成 AI agent 可以直接调用、检索、回溯、查找的记忆层。Knowhere 更偏现实场景一点,因为一开始弄这个项目,就是因为现实场景的文档太脏,普通解析更多面向办公场景的资料,对现实场景的脏文档解析效果不佳。 现在 Knowhere 又更新了一版,新增了一条纯视觉解析路线——vision-map ,更好地服务那些不便转化成文档的资料了。欢迎大家来试试: https://knowhereto.ai/github/?utm_source=v2ex 简单讲一下使用的场景。一份排版清晰的 Word 文档,转换成结构化文本以后,标题、段落和表格通常都能被准确保留下来。但如果面对的是扫描合同、复杂研报、演示文稿或者工程图纸,情况就不一样了。 这些文件中的信息不只存在于文字里,还存在于页面布局、表格关系、图形位置、颜色、标注和相邻内容之间。传统解析一旦读错顺序、...