DeepSeek网页版解锁“隐藏”能力:特定提示词或能逼近Max级推理深度
针对DeepSeek网页版是否具备最大思考深度的问题,社区挖掘出了一种通过特定提示词激发模型潜能的方法。用户引用官方技术报告中的概念,尝试通过输入要求“绝对最大投入且不允许走捷径”的指令,强制模型进行详尽的逻辑推演和压力测试。这一实验旨在验...
标签索引 / 第 22 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
针对DeepSeek网页版是否具备最大思考深度的问题,社区挖掘出了一种通过特定提示词激发模型潜能的方法。用户引用官方技术报告中的概念,尝试通过输入要求“绝对最大投入且不允许走捷径”的指令,强制模型进行详尽的逻辑推演和压力测试。这一实验旨在验...
本文作者对比评测了DeepSeek Pro (Max)与Anthropic Opus等主流模型。作者指出,虽然Anthropic最近的Opus 4.7版本在上下文处理上表现“偷懒”,但DeepSeek Pro凭借400k长文本的卓越记忆力和...
针对 DeepSeek 网页版缺乏会话管理功能的痛点,开发者近日开源了一款名为“DS Enhance”的油猴脚本。该脚本通过调用本地 API,为 DeepSeek Web 增加了多项高级特性,包括批量删除历史记录、自定义会话分类与标签、基于...
近日有科技社区用户实测发现,通过七牛云 API 调用 DeepSeek 模型(用户标注为 deepseek-v4-flash)时,其推理速度表现惊人。测试数据显示,七牛云的吐字速度(TPS)达到了 200 tokens/s 左右,相比之下,...
本文深入剖析了DeepSeek OCR的技术实现细节,详细拆解了从图片上传、生成唯一ID、监控上传进度,到通过任务队列进行异步推理的完整数据流。文章重点解读了其API交互逻辑,特别是对返回结果中包含的边界框坐标与文本类型标签(如 和 )的结...
本文基于DeepSeek的实际使用体验,提出了对AI发展的独到见解。作者认为,随着模型能力边际效应递减,用户需求并未无限膨胀,“足够好用”且“成本低廉”的模型将比追求“极致性能”的高价闭源模型更具市场竞争力。文章不仅肯定了DeepSeek展...
近期有科技爱好者在社区反馈,阿里云魔搭平台上部署的 DeepSeek 模型在体验上似乎优于官网版本。据观察,魔搭版在处理长文本检索(“大海捞针”)时未出现循环推理问题,且思维链长度控制得更为精简,提升了阅读效率。此外,该版本显著减少了幻觉现...
据开发者社区反馈,阿里云百炼平台已悄然集成DeepSeek大模型,提供了Flash和Pro两种版本。实测数据显示,得益于阿里云强大的基础设施优化,其推理速度表现惊人:Flash模式生成速度高达每秒175 tokens,Pro模式也达到了每秒...
近日,技术社区发现 Claude Code 会在 Prompt 中注入带有时间戳性质的归属头,导致 API 缓存机制大面积失效,显著增加了开发者的调用成本。经多名开发者利用 Gemini 和 DeepSeek V4 进行逆向分析验证,该问题...
针对DeepSeek(DS)Web版与Gemini Web版进行了深度对比实测,主要涵盖知识点讲解与HTML代码设计任务。测试结果显示,DeepSeek在回答质量上与Gemini Pro难分伯仲,基本具备“平替”能力。区别在于DeepSee...