Qwen3.5 27B 视觉实测翻车?开发者反馈 OCR 识别准确度反不如 8B
一位开发者在测试企业入职信息复核场景时发现,将 Qwen3 8B 升级至 Qwen3.5 27B 稠密模型后,证件信息的 OCR 识别准确率反而下降。在单张 A100 上部署非量化版本时,新模型出现了人名识别错误(如“许晨”误读为“许展”)...
标签索引 / 第 2 页
这个标签下有 21 篇文章。按时间回看相关判断与实践记录。
标签精选
一位开发者在测试企业入职信息复核场景时发现,将 Qwen3 8B 升级至 Qwen3.5 27B 稠密模型后,证件信息的 OCR 识别准确率反而下降。在单张 A100 上部署非量化版本时,新模型出现了人名识别错误(如“许晨”误读为“许展”)...
本文记录了Qwen3.5-2B及4B参数的Opus推理蒸馏版本在GTX 1650 4G显卡上的性能实测。测试任务为生成包含复杂动画效果的HTML/CSS/JS天气卡片代码。结果显示,2B模型处理速度高达38 tokens/s,而4B模型在q...
随着通义千问Qwen3.5-27B模型的发布,社区在利用vLLM框架进行高性能部署时遇到了配置难题。本文针对官方文档与vLLM文档在启动命令上的不一致性进行了对比分析,重点探讨了Data Parallelism (dp)、专家并行(enab...
Qwen(通义千问)正式推出3.5系列小型模型,涵盖0.8B、2B、4B和9B四个版本。该系列模型基于统一的Qwen 3.5平台构建,核心优势在于具备原生多模态能力、改进的架构以及扩展的强化学习机制。新模型针对不同场景进行了精准定位:0.8...
阿里巴巴千问团队宣布开源Qwen3.5系列的四款小尺寸模型(0.8B、2B、4B、9B),进一步完善开源生态。其中,0.8B和2B模型极致轻量,0.8B更是支持多模态,成为移动端与IoT设备的理想选择;4B模型被定位为轻量级Agent强劲基...
通义千问团队正式开源Qwen3.5系列的小尺寸模型,涵盖0.8B、2B、4B及9B四个规格。这些模型基于Qwen3.5统一基座打造,采用Apache 2.0开源协议,允许商业使用。新模型针对消费级显卡进行了深度优化,支持LoRA微调,大幅降...
阿里巴巴通义千问团队推出了全新的Qwen3.5 Medium系列模型,包含35B及122B等版本。令人瞩目的是,这些开源模型在基准测试中表现超越了OpenAI GPT-5-mini和Anthropic Claude Sonnet 4.5。该...
针对本地大模型部署环境,社区用户基于RTX 3090 24G显卡实测了Qwen 3.5-27B模型在Windows与Ubuntu双系统下的运行表现。在采用4bit量化及100% GPU卸载配置下,测试结果显示两者推理速度相近(Windows...
社区实测数据显示,通义千问最新版 Qwen 3.5 Plus 在百万级上下文处理能力上表现优异。在一场涵盖30轮对话、累计约5万 token 的复杂学习场景测试中,模型成功实现了全流程细节的精准抓取,未出现任何记忆丢失或幻觉问题。这一表现表...
阿里通义千问(Qwen)在春节期间悄然发布Qwen-3.5系列,引发科技圈高度关注。核心亮点在于推出了397B参数(A17B架构)的开源版本,并惊人地支持100万tokens的上下文窗口,这对处理长文本任务具有里程碑意义。在定价方面,国际版...