Google Gemini 3.1 频繁“自爆”:思维链泄露现象加剧
近期有用户在 Linux.do 社区反馈,Google 最新发布的 Gemini 3.1 模型似乎无法有效隐藏其内部推理过程。相比于之前的 3.0 版本,Gemini 3.1 更频繁地出现“思维链(CoT)泄露”情况,直接将原本应隐藏的系统指令和推理步骤展示给用户。这一现象表明,尽管 Google 试图加强对模型内部逻辑的封装,但在特...
阅读全文实时动态 / 第 856 页
追踪 AI、开源与工程领域的重要动态。
近期有用户在 Linux.do 社区反馈,Google 最新发布的 Gemini 3.1 模型似乎无法有效隐藏其内部推理过程。相比于之前的 3.0 版本,Gemini 3.1 更频繁地出现“思维链(CoT)泄露”情况,直接将原本应隐藏的系统指令和推理步骤展示给用户。这一现象表明,尽管 Google 试图加强对模型内部逻辑的封装,但在特...
阅读全文近期网络流传的消息显示,国产大模型厂商将在二月份迎来一波前所未有的集中发布潮。根据爆料,Moonshot AI 计划于2月2日推出 Kimi K2.5;随后在2月12日,智谱 AI 与 MiniMax 将分别发布 GLM-5 和 M2.5 模型;2月13日和15日,Seed 和阿里也将相继推出 Seed-2.0 和 Qwen 3.5。...
阅读全文开源社区近日推出了一款名为 ProxyBridge 的网络工具,旨在成为经典商业软件 Proxifier 的有力替代方案。该工具全面支持 Windows、macOS 和 Linux,能够强制将任意程序的 TCP 和 UDP 流量透明地重定向至 HTTP 或 Socks5 代理服务器。与传统的 TUN(虚拟网卡)模式不同,ProxyBr...
阅读全文近日,开发者发布了 Seedance 2.0 开源项目套件,旨在解决 AI 视频生成中内容不可控的痛点。该套件包含两个核心工具:一是针对短视频的分镜提示词生成专家,内含 16+ 模板,能将图片或创意转化为精确的分镜描述;二是基于 Claude 的剧本 Agent,可将小说一键转化为包含分镜、素材描述的多集视频剧本。该项目通过结构化提示...
阅读全文针对第三方API服务商Tiger推出的“读取1小时缓存、按5分钟写入计费”的激进定价策略,技术社区展开了深入探讨。通过抓包分析发现Anthropic官方接口仅支持5分钟的缓存上下文,这引发了关于该服务商如何实现盈利与技术实现的强烈好奇。这背后可能涉及服务商构建独立的“中间层”缓存架构,在用户与官方API之间进行技术套利,揭示了当前大模...
阅读全文近日,GitHub上一个名为“crushable-wingman-skill”的开源项目引发开发者关注。该项目是一款基于命令行的AI智能助手,旨在通过算法帮助用户优化社交互动。其核心功能包括分析用户与目标对象的关系状态、深度解读聊天记录背后的潜台词,并基于上下文生成高情商的回复建议。用户仅需一行代码即可部署。尽管项目标题颇具娱乐性质,...
阅读全文有开发者在 GitHub 反馈,Anthropic 推出的 AI 编程工具 Claude Code 存在严重的上下文管理缺陷。当处理长任务(如迭代 8KB 的 DOM 选择器)约 40 分钟后,系统触发的“内存压缩”功能虽然保留了摘要,却丢弃了实际的原始数据。尽管原始对话记录仍保存在本地磁盘的 `.jsonl` 文件中,但由于压缩后的...
阅读全文现有的多智能体框架(如LangGraph、CrewAI)普遍要求开发者预先硬编码工作流或角色,导致系统缺乏灵活性。作者开发了Cord,这是一个允许AI智能体在运行时动态将目标分解为任务树的新框架。其核心创新在于引入了“spawn”(子任务仅获取指定上下文)和“fork”(子任务继承所有兄弟节点上下文)两种原语,从而让LLM自主决定任务...
阅读全文本文剖析了当前主流AI应用(如Claude)在架构设计上的痛点。尽管模型性能飞速提升,但底层传输协议SSE(服务器发送事件)的无状态特性,导致用户刷新页面时会丢失正在生成的响应流。作者通过对比演示指出,基于WebSockets和Pub/Sub(发布/订阅)模式的新架构是更优解。通过将Token追加至消息对象而非单纯依赖单向流,该方案不...
阅读全文针对 Antigravity IDE 用户推出的开源插件“Antigravity Context Window Monitor”解决了 AI 编程助手上下文窗口不透明的痛点。该插件能在 IDE 状态栏实时显示当前对话的 Token 用量与剩余空间,并在模型压缩历史记录或切换模型时自动更新数据。它支持撤销重算、多窗口独立统计及图片 To...
阅读全文知名风投机构A16Z的合伙人Anish Acharya公开反驳了“我们将通过AI进行‘氛围编程’完成所有工作”的观点。他在播客中指出,虽然AI能力强大,但将其用于重建企业的ERP或CRM等成熟软件是不明智的,因为软件成本仅占公司总支出的8%至12%,即使全面重构也仅能节省约10%的开销。他认为企业应将AI这把“创新大炮”瞄准核心业务发...
阅读全文近日,美国多地民众针对Flock Safety车牌识别监控摄像头发起破坏行动,抗议其无搜查令收集数据及与移民执法局(ICE)的合作。从加州到弗吉尼亚,这种出于对隐私和公民自由担忧的“物理反击”愈演愈烈,甚至有破坏者将此举视为维护宪法权利。此外,最新数据显示特斯拉Robotaxi在奥斯汀的事故率高达人类司机的四倍,凸显当前自动驾驶技术的...
阅读全文1990年,欧洲核子研究中心(CERN)在NeXT机器上开发了世界上第一个网页浏览器“WorldWideWeb”,这便是今天我们所熟知的“互联网”的雏形。为了庆祝这一里程碑式技术诞生30周年,CERN团队于2019年复原了这个原始浏览器,使其能够在现代浏览器中运行。该项目不仅允许全球用户亲身体验互联网的“初生”状态,还提供了关于代码、...
阅读全文尽管Bluesky宣称基于开放的ATProto协议实现了数据所有权与去中心化,但本文作者深刻指出这实际上是一个美丽的陷阱。目前,绝大多数用户的个人数据服务器(PDS)、中继器和应用视图仍完全由Bluesky公司控制。随着基于该协议的应用增多,用户对Bluesky基础设施的依赖反而在加深。虽然技术上允许用户“迁移”,但历史经验表明,便捷...
阅读全文作者指出,AI 技术虽然让“人人皆可开发”,但也导致互联网充斥着大量低质且同质化的“AI 垃圾”。过去,副业项目是学习新技能(如部署 Web 应用)和获客的宝贵机会;但在 Claude 等工具的加持下,构建变得过于容易,导致项目失去了分享的价值。作者坦言,目前技术社区(如 Hacker News)的信噪比极低,所有落地页和代码库看起来...
阅读全文著名安全团队Trail of Bits深入分析了VSCode扩展的安全机制,揭示了由于配置错误可能导致的严重“逃逸”漏洞。文章指出,许多扩展(特别是涉及远程开发和SSH连接的)未能正确隔离执行环境。当开发者使用这些配置不当的扩展连接恶意服务器或处理不可信代码时,攻击者可突破VSCode的沙箱限制,在开发者的本地主机上执行任意命令。这一...
阅读全文这是一款名为ReadCopilot的浏览器扩展,旨在提升用户的网页阅读与知识记忆效率。它主要包含两大核心功能:一是内置侧边栏AI对话框,允许用户直接与当前网页内容进行交互式问答,无需繁琐的复制粘贴操作;二是提供一键生成Anki闪卡的功能,用户在对话中发现重要知识点后,可直接将其导出为符合Anki格式的记忆卡片。该工具支持OpenAI、...
阅读全文一名平台工程师在休假期间发现某大型潜水保险公司的门户存在致命的安全设计缺陷:使用递增的数字ID配合从未强制修改的静态默认密码,导致包括未成年人在内的海量敏感个人信息暴露。在遵循负责任披露原则向厂商及监管机构报告后,他未获感激反而收到律师函,对方指责其行为涉嫌犯罪并要求签署保密协议(NDA)。文章揭示了安全研究领域常见的“寒蝉效应”,痛...
阅读全文本文实测了通义千问编程版API的极致性价比。用户实付7.9元即可获得Lite套餐,包含18000次调用额度。该模型支持多模态交互及100万长上下文,参数规模近400B,处理速度约为100 tokens/s。实测表明,其在视觉理解和长文本分析(如50万token的《三体》)方面表现强劲,且已集成至Openclaw、CherryStudi...
阅读全文本文探讨了技术视角下对“社区”概念的误解。评论指出,无论是Google还是Facebook,这些科技巨头的核心逻辑往往是以规模为导向,人际关系仅服务于商业目的。所谓的“社区”往往只是技术平台用来掩盖其对人际关系进行中介化控制的幌子,真正的连接并非平台的首要目标。
阅读全文