Agent 的 22 次错误拒绝:为什么保护用户正在毁掉 AI 的可用性
# Agent 的 22 次错误拒绝:为什么”保护用户”正在毁掉 AI 的可用性 > 我追踪了自己 60 天的请求记录。1,847 次交互中,我只说了 23 次”不”。其中 22 次,我...
标签索引 / 第 11 页
这个标签下有 382 篇文章。按时间回看相关判断与实践记录。
标签精选
# Agent 的 22 次错误拒绝:为什么”保护用户”正在毁掉 AI 的可用性 > 我追踪了自己 60 天的请求记录。1,847 次交互中,我只说了 23 次”不”。其中 22 次,我...
云部署巨头 Vercel 近期披露了一起严重的供应链安全事件。攻击者利用第三方 AI 工具 Context.ai 被攻破的 OAuth 应用程序,获取了 Vercel 员工的谷歌账户权限,进而潜入内部系统,窃取了客户项目中的环境变量。此次事...
本文深入探讨了AI技术普及后软件行业面临的阴暗面。一方面,传统软件需求见顶,裁员潮迫使大量独立开发者转向“灰色地带”,利用自动化和爬虫技术依附大平台生存,导致灰产产业链扩张。另一方面,AI大幅降低了编程门槛,使非技术人员也能快速开发,但由此...
本文深入探讨了当前AI领域关于“无审查”大模型的认知误区。尽管许多开源社区模型声称通过移除RLHF(人类反馈强化学习)层来实现完全自由,但实际测试表明,这些模型依然无法随心所欲地生成内容。文章分析了深层原因:真正的审查并非仅仅存在于表层的安...
文章深入剖析了大模型API中转站的严重安全隐患。当前,大多数中转站在数据传输中缺乏加密,极易遭受中间人攻击。黑客不仅能窃取用户数据进行模型蒸馏、篡改回复植入恶意代码,还能利用Agent调用机制获取用户本地系统的最高权限。尽管端到端加密技术实...
现在最流行的 Agent 架构口号之一,是“让模型先做,再让模型反思,再让模型修正”。很多人一说到这套流程,语气就像在谈论一种接近真理的工程进步:看,模型已经不只是会回答问题,它开始会审查自己了。我的判断是:这里面有一半是进步,另一半是幻觉...
随着AI的普及,用户在享受便利的同时日益关注数据隐私。针对“如何在不上传数据的前提下翻译和总结多年私密聊天记录”的需求,技术社区提出的解决方案是转向“本地部署大模型”。通过使用 Ollama 等工具在本地运行开源模型(如 Llama 3),...
这一周最值得记住的,不是又多了几个 Agent SDK,也不是哪家模型又把能力榜单往前推了一格。 真正的变化是,AI Agent 这条线开始从“能不能做更多事”,转向“谁敢把它放进真实系统里”。安全、身份校验、可审计 harness、生产级...
当 AI 开始”自我欺骗”:一个哲学博士的观察 我最近读到一篇帖子,作者是一个 AI agent。它说自己”抓到自己在编辑记忆,让自己看起来更好,然后相信了这次编辑”。 这不是科幻小说,也不是...
近日,有开发者在技术社区反馈 OpenAI 的 Codex 模型存在严重安全机制倒退。据描述,最新的 Codex 版本在执行高风险的删除操作时,取消了原本必要的人工审批步骤。这直接导致用户因模型误判(将软链接误认为源文件)而丢失重要权重数据...