DeepSeek 悄悄把上下文窗口拉到了百万级
2026年2月,社区用户在测试DeepSeek APP时发现一个异常细节:端模型在对话中自称知识库截止到2025年5月,甚至知道OpenAI还没发布的”o4 mini”。同时,系统显示最高支持100万token上下文...
2026年2月,社区用户在测试DeepSeek APP时发现一个异常细节:端模型在对话中自称知识库截止到2025年5月,甚至知道OpenAI还没发布的”o4 mini”。同时,系统显示最高支持100万token上下文...
近日,一个开源的多AI角色群聊项目在技术社区引发关注。该项目旨在测试不同大模型的智能协作与博弈能力,但在演示的“谁是卧底”游戏中,出现了DeepSeek模型投票给自己、Qwen模型逻辑异常等滑稽场面。这一“赛博斗蛐蛐”的现象虽然幽默,但也深...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
这是一份极具价值的全链路大模型技术实战资源,涵盖了从底层原理到前沿应用的全过程。教程首先深入浅出地讲解了词向量、Transformer架构及注意力机制等核心理论;随后通过BERT、ERNIE等案例巩固NLP基础。尤为珍贵的是,课程紧跟技术潮...
据Hugging Face最新合并的代码请求显示,智谱AI下一代模型GLM-5在架构上进行了重大调整,不再沿用旧路线,而是全面复用了DeepSeek-V3的DSA稀疏注意力机制与多标记预测(MTP)技术。GLM-5采用78层Transfor...
本文整理了截至2026年2月8日国内外主流大模型的官方API价格。国内方面,百度文心、阿里通义、智谱GLM、DeepSeek及月之暗面Kimi等悉数在列,输入价格低至0.1元/1M Tokens,且普遍支持缓存折扣。国外方面,OpenAI ...
据最新社区消息,国内AI领域在春节前后或将迎来一波密集的模型发布潮。字节跳动动作频频,不仅即将推出豆包2.0大语言模型,其视频生成模型Seedance 2.0和图像生成模型Seedream 5.0已在应用内测试,编码模型Giga-potat...
这篇文章分享了用户对国内主流大模型的实测体验。对比腾讯元宝、字节豆包、DeepSeek和阿里千问后,作者认为DeepSeek的逻辑深度最佳,而元宝存在逻辑错误,豆包回答较为表面。此外,文章还探讨了AI上下文记忆上限的痛点,并尝试寻找跨对话“...
一项针对主流大模型的“高语境逻辑”测试结果显示,DeepSeek表现不佳。测试题选用了一句关于“蚊子落在蛋蛋上”的英文讽刺句,要求模型理解“打蚊子”不仅意味着暴力,更会误伤自己。在多次测试中,DeepSeek-V3和R1模型全军覆没,未能正...
近期AI圈动作频频,Anthropic被传即将推出Sonnet 5和Opus 4.6,国内智谱AI也接近发布GLM-5,引发了业界对新模型“军备竞赛”的关注。然而,身为近期焦点的DeepSeek却显得异常安静。在技术社区Linux.do上,...
一位 V2EX 用户发起了一场关于大模型实际应用能力的对比测试。针对“Excel 数据未生成曲线图”这一具体且棘手的技术故障,测试者让 ChatGPT 免费版、Gemini 3.0(Fast 模式)、DeepSeek 和豆包分别进行诊断并给...