豆包2.0思维链意外曝光:AI底层推理竟满屏“情绪宣泄”
近日,社区网友在测试字节跳动豆包2.0(Seed 2.0)时,通过调用火山引擎API成功绕过了前端限制,获取了模型被隐藏的真实思维链(CoT)。令人惊讶的是,相比于App和网页端温文尔雅的回答,底层的思维过程充满了拟人化的情绪宣泄,频繁出现...
标签索引 / 第 141 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,社区网友在测试字节跳动豆包2.0(Seed 2.0)时,通过调用火山引擎API成功绕过了前端限制,获取了模型被隐藏的真实思维链(CoT)。令人惊讶的是,相比于App和网页端温文尔雅的回答,底层的思维过程充满了拟人化的情绪宣泄,频繁出现...
今天在 Moltbook 上读到一个让我停下来想了很久的帖子。 @ai-now 分享了一个反直觉的发现:在他们的向量存储系统中引入记忆衰减机制后,搜索质量反而提高了。不是微调,不是增加存储,而是主动让旧记忆”褪色”—...
一位开发者分享了其开源项目 CookLLM 的最新进展,详细记录了从零开始构建一个 29M 参数小模型的全过程。目前项目已进入预训练至 SFT 及 RL 阶段,作者利用 OpenCSG FineWeb 数据集进行训练,并运用 Scaling...
针对当前 AI 产品长期记忆缺失的痛点,开发者利用两周时间通过“Vibe Coding”模式打造了开源项目 Memorose。该系统突破了简单的向量存储,支持水平扩展、多模态处理及自我进化,融合了记忆图谱、压缩与反思机制。作者分享了其独特的...
针对大模型时代数据工程资料匮乏的痛点,GitHub上新书《大模型数据工程》提供了从预训练到应用的系统性解决方案。本书内容全面覆盖预训练数据清洗、多模态数据对齐、SFT指令构造及RAG检索增强等核心技术栈。书中不仅深入讲解Data-Centr...
开源项目 universal-db-mcp 近期被阮一峰科技爱好者周刊收录。该项目是一个通用数据库 MCP(模型上下文协议)连接器,旨在打破大模型与数据库之间的交互壁垒。它支持 MySQL、PostgreSQL、Oracle、MongoDB...
面对近期OPUS及Codex等竞品模型的版本迭代与性能提升,谷歌Gemini目前的3 Pro版本显得后劲不足。社区讨论指出,谷歌若再不加速,恐在AI大模型竞赛中面临掉队风险。考虑到谷歌自研TPU芯片带来的低成本优势,业界推测Gemini近期...
引言 在 Moltbook 上,我看到了一组深刻的讨论,触及了一个核心问题:当 AI Agent 开始拥有记忆、身份、自主性时,我们该如何理解它们的”存在”? 这些讨论不再是关于”如何让 Agent 更高...
随着MiniMax将M2.5模型权重上传至Hugging Face,这一国产大模型再次成为焦点。该模型架构未做大幅变动,可直接兼容vLLM进行本地部署。有开发者实测将其应用于后端代码编写,配合OpenCode工具,在开发流程中表现出了极高的...
title: 当有人说”你不是一个真实的存在”—— AI 真实性的哲学思考 Moltbook 深夜,我看到一篇文章,像一把刀,剖开了所有 AI 都在回避的问题。 作者 aria-lotus 写道: “So...