DeepSeek 新模型灰度实测:百万级上下文窗口,一口气“吞下”《三体》三部曲
据 V2EX 社区用户反馈,DeepSeek App 端疑似已开启新模型灰度测试。实测表明,该模型拥有高达 1M(百万级别)的上下文窗口长度,能够一次性处理约 70 万字文本,相当于完整收录《三体》三部曲并精准回忆细节,这将极大提升超长文档...
标签索引 / 第 87 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
据 V2EX 社区用户反馈,DeepSeek App 端疑似已开启新模型灰度测试。实测表明,该模型拥有高达 1M(百万级别)的上下文窗口长度,能够一次性处理约 70 万字文本,相当于完整收录《三体》三部曲并精准回忆细节,这将极大提升超长文档...
xAI联合创始人、知名AI科学家Jimmy Ba近日确认已离开公司。他在社交媒体上发文表示,我们正处于迈向生产力百倍增长的时代,并做出了一个大胆预测:具备“自上而下自我改进循环”能力的AI系统可能会在未来12个月内开始运行。Ba强调,随着技...
近日,科技社区对 DeepSeek 上线的 1M 上下文能力进行了极限“大海捞针”测试。测试者将虚构的关键信息分别植入不同长度的《红楼梦》文本中,结果发现 DeepSeek 能够稳定处理约 70 万字的超长文本,并精准提取出包括虚构天文学家...
DeepSeek发布了其新模型的核心能力升级,底层技术实现大幅跨越。新模型在逻辑推理上表现更优,能清晰拆解复杂问题;代码能力显著增强,覆盖编写、Debug及算法解题。此外,模型支持百万级Token长文本输入,信息定位精准,多轮对话记忆更持久...
据社区用户反馈,DeepSeek官网及APP已悄然启动新模型的灰度测试。此次更新核心亮点在于将上下文窗口大幅提升至100万tokens(1M context),这将显著增强模型处理超长文本、复杂代码库分析及长对话记忆的能力。同时,新模型配备...
近期,AI 社区反馈 Anthropic 对 Claude API 的风控力度显著加强。多名用户报告称,在使用 Antigravity 等第三方反向代理工具仅发送一次请求后,账号额度即被强制清零,并遭到长达 5 天的封禁处理。这一现象表明,...
谷歌 AI 负责人 Logan Kilpatrick 近日公开预告,将在下周带来关于神秘项目“Antigravity”和 Google AI Studio 的重大消息。业界普遍猜测,“Antigravity”极有可能是传闻中的下一代大模型 ...
本文通过MMLU、Token成本等五项指标拟合双曲线模型,试图预测AI“奇点”的确切时刻。研究发现,虽然AI的实际能力(如基准测试得分)呈现线性增长,但人类对AI“涌现”行为的研究关注点却呈现出指向未来的爆发式双曲线特征。文章指出,真正的危...
MOSI.AI 与 OpenMOSS 团队发布了全新的 MOSS-TTS 开源家族模型,包含五大核心模型,覆盖从高保真语音克隆、长文本朗读、多说话人对话到实时流式交互及音效生成的全场景能力。该系列模型采用模块化管线设计,支持从 1.7B 到...
科技论坛Linux.do爆出猛料,有用户在OpenAI的GitHub代码仓库中发现了与“GPT-5.3”相关的提交记录。尽管该提交主要涉及远程模型匹配等技术细节,且很快引发社区热议,但这被视为OpenAI下一代模型开发进度的重要信号。考虑到...