DeepSeek长上下文能力实测:成功吞下200KB代码库,多轮问答精准无幻觉
社区用户实测发现,DeepSeek App新模型在长上下文处理方面表现卓越。测试者利用repomix将一个200KB的代码库上传至DeepSeek,尽管官方宣称支持100万Token(1M)上下文,但实测显示模型响应速度极快(高TPS),在...
社区用户实测发现,DeepSeek App新模型在长上下文处理方面表现卓越。测试者利用repomix将一个200KB的代码库上传至DeepSeek,尽管官方宣称支持100万Token(1M)上下文,但实测显示模型响应速度极快(高TPS),在...
针对DeepSeek近期支持的百万级长上下文窗口,社区开发者正在积极探索其实际落地场景。近日,一款名为“deepseek_memory”的浏览器插件在Linux.do论坛开源,旨在通过附加全局记忆信息来增强DeepSeek的对话能力。尽管目...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
一位开发者分享了使用 Claude Code 开发的《幸福工厂》生产计算器项目。作为首个开源尝试,作者在开发过程中对比了 GLM-5、DeepSeek V3.2 及小米 Mimo V2FLASH 等国产大模型,发现它们在复杂编程任务上的效果...
DeepSeek 昨晚悄然更新了 API 文档,新增了一条关键注意事项。文档明确指出,目前 API 接口中的 `deepseek-chat` 和 `deepseek-reasoner` 对应的模型版本保持为 `DeepSeek-V3.2`(...
根据科技社区用户的最新讨论,DeepSeek 的新模型在不启用深度思考功能时依然表现出色。实测显示,该模型在长上下文处理能力上十分扎实,能够有效维持对话记忆,不再轻易遗忘之前的信息。更重要的是,用户普遍反映模型之前那种动不动就产生“科幻”内...

本周概览 本周AI行业两条主线:美国巨头忙着企业化变现,中国厂商密集发新模型抢市场。OpenAI推芯片计划和Codex新模型,Anthropic完成史上最大AI融资,Google砸钱扩算力。中国这边,智谱GLM-5发布、MiniMax香港上...
北京大学肖睿团队推出了一套名为“DeepSeek赋能系列”的AI实操教程资源,旨在通过系统教学普及国产大模型应用。该系列涵盖零基础AI视频制作、AI绘画大师课程,以及利用AI实现Excel数据可视化与PPT/Word高效办公。此外,课程特别...
DeepSeek 近日被用户发现模型回答语气更自然,官方随即确认正在网页端及 APP 测试全新的长文本模型架构。此次更新最引人注目的是支持高达 100 万 token(1M)的上下文窗口,显著提升了处理超长文档的能力。不过官方澄清,API ...
针对现有翻译软件可能存在的资源占用问题,本文介绍了一种适用于Linux Wayland环境的极客级解决方案。作者通过Bash脚本结合 `wtype` 和 `wl-clipboard` 工具,模拟按键操作直接调用 OpenAI 或 DeepS...
本文探讨了在即时通讯场景下部署AI机器人的模型选择痛点。发帖者实测发现,目前热门的DeepSeek v3.2存在严重的“人机感”和上下文理解短板,且缺乏原生视觉能力,不得不借助Qwen识图但效果不佳。相比之下,Gemini在多图处理上易出现...