DeepSeek 网页端实测:疑似解锁 1M 超长上下文,知识库截止 2025 年 5 月
继移动端之后,DeepSeek 似乎正在网页端灰度测试 1M token 的超长上下文能力。用户在开启“深度思考”模式后测试发现,模型自述上下文窗口已达 1M,且知识库更新日期延续至 2025 年 5 月。若属实,这将标志着 DeepSee...
标签索引 / 第 16 页
这个标签下有 197 篇文章。按时间回看相关判断与实践记录。
标签精选
继移动端之后,DeepSeek 似乎正在网页端灰度测试 1M token 的超长上下文能力。用户在开启“深度思考”模式后测试发现,模型自述上下文窗口已达 1M,且知识库更新日期延续至 2025 年 5 月。若属实,这将标志着 DeepSee...
2026年2月,社区用户在测试DeepSeek APP时发现一个异常细节:端模型在对话中自称知识库截止到2025年5月,甚至知道OpenAI还没发布的”o4 mini”。同时,系统显示最高支持100万token上下文...
本文详细介绍了一套利用AI技术复刻特定人物言语风格的完整技术方案。内容涵盖从微信等渠道导出聊天记录、进行数据清洗与格式转化,到利用Qwen等大模型进行LoRA微调训练的全过程。文章深入浅出地解析了微调参数(如Epochs、Learning ...
薄荷公益站宣布全面恢复并升级 Gemini 3 Pro 系列模型服务。此次更新的模型阵容包括 gemini-3-pro-high、gemini-3-pro-low 及多个 preview 版本。其中,gemini-3-pro-high 通过...
随着 Claude Opus 4.6 的发布,许多使用 OpenClaw 调用 Google Antigravity 反代接口的用户遭遇了旧版模型被下线、新版模型未收录的“断层”报错。由于 OpenClaw 官方依赖包更新滞后,社区开发者迅...
近日,一张包含中文谐音梗的趣味图片在科技圈走红,成为测试各大AI模型多模态识图与中文语义理解能力的“考题”。测试涵盖了GPT、豆包、Gemini、Qwen、MiniMax及GLM等主流模型。结果显示,各模型表现参差不齐:豆包、MiniMax...
AI 社区此前盛传 Anthropic 将发布代号为“20260203”的 Claude Sonnet 5 模型,引发业界高度关注。然而,Anthropic 并未按剧本出牌,而是直接推出了 Claude Opus 4.6。这一举动不仅打破了...
AI竞技场正式发布了其自研的智能路由模型“Max”。该模型定位为智能编排器,旨在利用海量社区数据,将用户Prompt精准路由至最合适的处理模型。在最新的性能测试中,Max的基础版本表现惊人,其综合得分及专家能力、高难度提示、编程、数学、写作...
近日,科技社区热议国内外AI发展的巨大温差。当OpenAI和Anthropic在SOTA(最先进技术)模型赛道上激烈角逐时,国内科技圈却呈现出另一番景象:腾讯元宝与微信被指仍在进行内部资源博弈,而Qwen等大模型厂商被曝出在社群内搞“发奶茶...
近期AI圈动作频频,Anthropic被传即将推出Sonnet 5和Opus 4.6,国内智谱AI也接近发布GLM-5,引发了业界对新模型“军备竞赛”的关注。然而,身为近期焦点的DeepSeek却显得异常安静。在技术社区Linux.do上,...