DeepSeek新模型长文本能力实测:74万上下文召回率85%,有效窗口约32.5万Token
据社区技术讨论显示,DeepSeek即将发布的新模型在超长文本处理方面表现惊艳。在针对约74.2万Tokens的复杂文本“大海捞针”测试中,模型成功召回14个指令,整体召回率高达85%。尽管由于中间位置指令丢失,推算出的注意力有效上下文窗口...
据社区技术讨论显示,DeepSeek即将发布的新模型在超长文本处理方面表现惊艳。在针对约74.2万Tokens的复杂文本“大海捞针”测试中,模型成功召回14个指令,整体召回率高达85%。尽管由于中间位置指令丢失,推算出的注意力有效上下文窗口...
本文源于用户在 Linux.do 的反馈,指出了 DeepSeek 在实际应用中存在的显著短板。尽管该模型在理论上能深刻阐释 LLM 与人类语言机制的差异,展现了不错的基础能力,但在具体的搜索任务中表现不佳。测试发现,DeepSeek 缺乏...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
近日,Linux.do 社区针对 OpenClaw 项目的应用场景发起了投票与讨论。一位用户分享了其在 NAS 上部署 OpenClaw 并接入 DeepSeek 与企业微信的实测方案,指出目前虽实现了内网打通与交互,但尚未感受到颠覆性体验...
随着国产大模型的崛起,学术界在“沉浸式翻译”工具中的模型选择成为热点。近日,Linux.do 社区有用户针对医学专业文本,对 DeepSeek、千问及 GPT 三款轻量级模型进行了对比实测。结果显示,虽然国产模型表现不俗,但 GPT 在专业...
近日,DeepSeek发布的新模型在技术论坛引发轰动。有开发者测试后表示,其智能程度令人惊叹,不仅拥有百万级上下文窗口,在长文本创作(如小说生成)方面表现出色,甚至让人产生“看到了GPT-5”的错觉。然而,多位参与者也指出,该模型目前仍存在...
近日,技术社区Linux.do上有用户发现,热门AI模型DeepSeek在回答特定问题时存在严重的随机性缺陷。针对“linuxdo是什么”这一固定问题,DeepSeek每次生成的回答均不相同,内容差异巨大。这一现象引发了社区对于模型“幻觉”...
社区用户通过上传约3MB的测试数据,对DeepSeek APP端模型进行了极限测试。测试结果显示,该模型疑似已支持100万token的超长上下文窗口,并成功通过了严苛的“大海捞针”测试,能够精准定位并提取隐藏在超长文本中的关键信息。这一发现...
科技社区近期热议DeepSeek疑似发布新版本。多位用户反馈,针对此前模型难以解答的复杂逻辑测试问题,新版本已能轻松攻克,显示出明显的智商跃升。这一迹象表明,DeepSeek在模型迭代上进展迅速,其代码生成与数学推理等核心能力可能迎来了新一...
近日,有用户在Linux.do论坛分享了DeepSeek网页端疑似更新的系统提示词。内容显示,DeepSeek自称最新模型,知识截止日期标注为2025年5月,并确认支持100万上下文窗口及多种格式文件上传。最引人注目的是,该提示词包含极严格...
据 V2EX 社区用户反馈,DeepSeek App 端疑似已开启新模型灰度测试。实测表明,该模型拥有高达 1M(百万级别)的上下文窗口长度,能够一次性处理约 70 万字文本,相当于完整收录《三体》三部曲并精准回忆细节,这将极大提升超长文档...