提示词重复奇迹:显著提升DeepSeek等大模型准确性
本文通过实战测试验证了“重复提示词”对提升大模型准确性的效果。测试对象涵盖DeepSeek、Qwen Plus和Doubao 1.8。结果显示,仅输入一遍时DeepSeek错误率较高,但重复输入两遍后,所有模型准确率均大幅提升。此外,测试还...
标签索引 / 第 51 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
本文通过实战测试验证了“重复提示词”对提升大模型准确性的效果。测试对象涵盖DeepSeek、Qwen Plus和Doubao 1.8。结果显示,仅输入一遍时DeepSeek错误率较高,但重复输入两遍后,所有模型准确率均大幅提升。此外,测试还...
DeepSeek FlashMLA源码库近日大幅更新,新增对MODEL1新架构及英伟达SM100芯片的支持。代码显示,MODEL1并非对V3的修补,而是通过回归512标准维度、首创“值向量位置感知”及疑似引入Engram和DSA机制,实现了...
监测数据显示,GitHub上正频繁发生API凭证泄露事件,每小时都有包括OpenAI、DeepSeek、Anthropic及Google AI在内的平台密钥被公开。这些泄露多因开发者误将包含敏感信息的.env文件上传至公共仓库所致。由于发现...
研究员利用8张H100 GPU成功复现DeepSeek提出的mHC架构。实验表明,传统超连接(HC)在1.7B规模下会出现信号激增超万倍的严重不稳定性。而DeepSeek的mHC通过数学约束将信号完美锁定,不仅彻底消除了训练崩溃的风险,且未...
SWE-rebench公布了基于2025年12月GitHub真实任务的最新评测榜单。Anthropic的Claude Opus 4.5以63.3%的解决率位居榜首,OpenAI GPT-5.2与谷歌Gemini 3 Flash Previe...
DeepSeek近日更新了R1论文,披露其训练成本不到30万美元。这一数字远低于行业巨头动辄上亿美元的投入,展示了其在算法与工程优化上的惊人实力。这一突破不仅打破了算力垄断的神话,更给OpenAI等竞争对手带来了巨大压力,标志着AI大模型研...
这是一款基于 AI 的 Git 命令行工具,旨在解决开发者编写 Commit Message 和整理周报的痛点。它能读取 Diff 自动生成符合规范的提交信息,并一键归类生成周报。技术层面,该工具除兼容 OpenAI 外,重点优化了高性价比...
vLLM团队宣布完成向V1引擎的全面迁移,通过集成Wide-EP、双批次重叠(DBO)及专家并行负载均衡(EPLB)等优化,在H200集群上实现每GPU 2.2k tokens/s的吞吐量。这一显著性能提升解决了DeepSeek等稀疏MoE...
据社区用户观察,DeepSeek网页版界面近日进行了静默更新。新UI在设计语言上转向了更圆润的风格,整体操作手感也更加丝滑流畅。此次改版显示DeepSeek在专注大模型核心能力突破的同时,日益重视产品侧的用户体验打磨,旨在通过更友好的交互设...
DeepSeek发布最新研究成果“Engram”,提出通过可扩展查找实现条件记忆。该论文探索了大语言模型稀疏性的新维度,旨在优化模型的记忆机制与检索效率,为解决长上下文处理和计算资源消耗问题提供了新的技术路径,代码已在GitHub开源。 原...