智谱AI旗下的轻量级OCR模型GLM-OCR正式发布。该模型参数量仅为0.9B,延续了当前AI模型向端侧和轻量化发展的趋势。官方数据显示,尽管体积小,但其在公式识别、表格还原和信息提取方面均达到SOTA(当前最佳)水平。在性能测试中,GLM-OCR处理PDF的速度可达1.86页/秒,显著优于同类竞品。这一突破意味着在算力有限的普通服务器或端侧设备上,也能低成本运行高精度的文档结构化任务,非常适合处理复杂PDF、发票及论文等场景。目前模型权重已在Hugging Face开源,并提供API试用。
挑战 SOTA 的轻量级模型:GLM-OCR 发布,0.9B 参数实现端侧高性能文档解析
未经允许不得转载:80aj » 挑战 SOTA 的轻量级模型:GLM-OCR 发布,0.9B 参数实现端侧高性能文档解析
相关推荐
无需联网也能翻译?独立开发者推出“秒译”App,探索端侧AI隐私新边界
Chrome浏览器AI功能被指“偷吃”4GB存储,教你如何找回空间
挑战云端隐私痛点:开发者推出 iPhone 全离线 AI 实时翻译 App NonetPlay
小参数大能耐:ZAYA1-8B数学能力匹敌DeepSeek-R1,AMD入局引发热议
GitHub开源新星:香港大学团队推出超轻量级个人AI智能体Nanobot
谷歌 Chrome 被曝在用户不知情下静默安装 4GB 本地 AI 模型
440MB模型吊打谷歌?Hy-MT极致量化实测惊艳,展现端侧AI新潜力
Android本地AI Agent「Aether扶摇」正式开源,可操控手机GUI