一位科技爱好者在Linux.do社区发帖求助,指出处理东亚纵向排版(竖排文字)的PDF文档依然是当前软件和AI的痛点。经实测,WPS等传统办公软件在转换时会出现乱码;而DeepSeek、豆包等头部国产大模型也未能幸免,只能识别出部分文本,无法完美还原。这一现象揭示了多模态大模型虽然在常规场景表现优异,但在处理非标准排版、特殊格式等“长尾场景”时,OCR能力仍存在明显局限,尚未达到真正“办公解放”的预期标准。
纵向PDF转码成盲区:WPS失灵,DeepSeek与豆包也难以招架
未经允许不得转载:80aj » 纵向PDF转码成盲区:WPS失灵,DeepSeek与豆包也难以招架
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价
技术指南:将免费DeepSeek模型接入Claude Code的实战方案
实测“魔改”Claude接入DeepSeek:极致性价比下的“降智”妥协