DeepSeek 网页端实测:疑似解锁 1M 超长上下文,知识库截止 2025 年 5 月
继移动端之后,DeepSeek 似乎正在网页端灰度测试 1M token 的超长上下文能力。用户在开启“深度思考”模式后测试发现,模型自述上下文窗口已达 1M,且知识库更新日期延续至 2025 年 5 月。若属实,这将标志着 DeepSee...
标签索引 / 第 47 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
继移动端之后,DeepSeek 似乎正在网页端灰度测试 1M token 的超长上下文能力。用户在开启“深度思考”模式后测试发现,模型自述上下文窗口已达 1M,且知识库更新日期延续至 2025 年 5 月。若属实,这将标志着 DeepSee...
据社区用户反馈,DeepSeek官网及APP已悄然启动新模型的灰度测试。此次更新核心亮点在于将上下文窗口大幅提升至100万tokens(1M context),这将显著增强模型处理超长文本、复杂代码库分析及长对话记忆的能力。同时,新模型配备...
2026年2月,社区用户在测试DeepSeek APP时发现一个异常细节:端模型在对话中自称知识库截止到2025年5月,甚至知道OpenAI还没发布的”o4 mini”。同时,系统显示最高支持100万token上下文...
近日,一个开源的多AI角色群聊项目在技术社区引发关注。该项目旨在测试不同大模型的智能协作与博弈能力,但在演示的“谁是卧底”游戏中,出现了DeepSeek模型投票给自己、Qwen模型逻辑异常等滑稽场面。这一“赛博斗蛐蛐”的现象虽然幽默,但也深...
这是一份极具价值的全链路大模型技术实战资源,涵盖了从底层原理到前沿应用的全过程。教程首先深入浅出地讲解了词向量、Transformer架构及注意力机制等核心理论;随后通过BERT、ERNIE等案例巩固NLP基础。尤为珍贵的是,课程紧跟技术潮...
据Hugging Face最新合并的代码请求显示,智谱AI下一代模型GLM-5在架构上进行了重大调整,不再沿用旧路线,而是全面复用了DeepSeek-V3的DSA稀疏注意力机制与多标记预测(MTP)技术。GLM-5采用78层Transfor...
本文整理了截至2026年2月8日国内外主流大模型的官方API价格。国内方面,百度文心、阿里通义、智谱GLM、DeepSeek及月之暗面Kimi等悉数在列,输入价格低至0.1元/1M Tokens,且普遍支持缓存折扣。国外方面,OpenAI ...
据最新社区消息,国内AI领域在春节前后或将迎来一波密集的模型发布潮。字节跳动动作频频,不仅即将推出豆包2.0大语言模型,其视频生成模型Seedance 2.0和图像生成模型Seedream 5.0已在应用内测试,编码模型Giga-potat...
这篇文章分享了用户对国内主流大模型的实测体验。对比腾讯元宝、字节豆包、DeepSeek和阿里千问后,作者认为DeepSeek的逻辑深度最佳,而元宝存在逻辑错误,豆包回答较为表面。此外,文章还探讨了AI上下文记忆上限的痛点,并尝试寻找跨对话“...
一项针对主流大模型的“高语境逻辑”测试结果显示,DeepSeek表现不佳。测试题选用了一句关于“蚊子落在蛋蛋上”的英文讽刺句,要求模型理解“打蚊子”不仅意味着暴力,更会误伤自己。在多次测试中,DeepSeek-V3和R1模型全军覆没,未能正...