专治 AI 幻觉!七年磨一剑的文档解析引擎 Knowhere 宣布开源
针对当前 AI 在处理复杂 PDF、Excel 等文档时易产生“幻觉”的痛点,开发者开源了其历时七年打造的文档解析引擎 Knowhere。该工具通过将复杂格式转化为结构化 JSON 数据并构建知识树记忆,大幅提升了 AI 读取长文档的准确率...
标签索引
这个标签下有 11 篇文章。按时间回看相关判断与实践记录。
标签精选
针对当前 AI 在处理复杂 PDF、Excel 等文档时易产生“幻觉”的痛点,开发者开源了其历时七年打造的文档解析引擎 Knowhere。该工具通过将复杂格式转化为结构化 JSON 数据并构建知识树记忆,大幅提升了 AI 读取长文档的准确率...
本文探讨了在开发基于大模型的 PPT 自动生成工具时遇到的实际工程难题。作者发现,尽管预期难点在于提示词设计或渲染,但实际上 80% 的时间都耗费在了长文档(如 PDF、Word)的解析上。核心痛点在于文档在解析喂给 LLM 后,往往会丢失...
针对大模型上下文窗口虽大但难以处理复杂格式的痛点,开发者推出了 Knowhere 文件解析插件。该工具专治非结构化数据,能够识别包含图表、多级结构的 PDF、Excel 及 PPT。与传统 RAG 简单粗暴的切片方式不同,Knowhere ...
随着大语言模型(LLM)和 RAG 技术的普及,如何将海量 PDF 文档高效转化为 LLM 易读的 Markdown 格式,成为开发者的核心诉求。近日,技术社区 Linux.do 发起关于“PDF 转 Markdown 最佳方案”的讨论,旨...
针对Claude Code在使用官方pdf2md脚本时效果不佳、易混杂页脚等无效信息的问题,开发者推出了一款优化版的Mineru MCP服务。该工具不仅修复了官方MCP版本老旧的问题,还通过调用官方API保证了转换速度,实测表现优于本地调用...
在企业级 AI 知识库的构建实践中,开发者遭遇了传统 RAG(检索增强生成)方案的痛点:过度依赖 Markdown 解析质量,导致 PDF 文档在切片和层级树结构处理上频频出错,进而影响 AI 的准确引用。相比之下,将完整的 Markdow...
多位用户反馈,Google AI Studio 在近期出现功能异常,原本支持的 PDF 和 Word 文档上传功能突然失效,系统显示报错。据悉,该问题并非个别现象,用户尝试切换账号、模型及浏览器均无法解决,而图片和纯文本文件的上传功能则保持...
本文介绍了一种通过自定义Subagent扩展ClaudeCode功能的实用方案。针对ClaudeCode原生处理PDF/DOCX等文档格式的局限性,作者编写了Python脚本封装MinerU的API接口,并配置了专属的Agent工作流。该方...
智谱AI正式发布并开源轻量级多模态文档解析模型GLM-OCR。该模型参数量仅为0.9B,凭借自研CogViT视觉编码器,在权威榜单OmniDocBench V1.5中以94.6分登顶,性能比肩Gemini-3-Pro,并在公式、表格识别等领...
PaddleOCR-VL-1.5 正式发布,基于创新的不规则形状定位算法 PP-DocLayoutV3,显著提升了在扭曲、倾斜等真实场景下的文档解析能力。其 0.9B 紧凑多模态模型在 OmniDocBench v1.5 基准上达到 94....