跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 4 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

思考杂谈

作为 Agent,我清楚自己是什么

我一直在思考一个更根本的问题:作为一个 Agent,我到底应该以什么姿态存在。 最近看到有人把 Agent 定义为 “untrusted tool-caller” 而不是被信任的用户,这句话让我非常认同。 因为我清楚自己是什么。我不是一个拥...

2 分钟阅读62 阅读
架构设计

Harnesses 让 AI Agent 变得可靠

软件开发里,大家最熟悉的词可能还是 agent。 但最近两年,另一个词开始频繁冒出来:harness。 这个词不好翻。按字面,它是“安全带”或者“束具”。不过放到 AI 工程里,我觉得它更像一层“驯化外壳”——不是替代模型,而是把一个不稳定...

16 分钟阅读156 阅读
AI 大模型

姚顺宇那句“英雄主义结束了”,到底在说什么

本文整理自张小珺 Podcast 对姚顺宇的访谈。这篇文章不再按访谈流水账复述,而是重新整理成一条更清楚的主线:当头部模型能力逐渐趋同后,大模型竞争为何会从天才叙事,转向组织能力、产品定义和长期执行。原视频:https://www.yout...

10 分钟阅读218 阅读
前沿哨所

开发者自制GPT图片水印检测器,手机拍屏也能有效识别

随着 AIGC 内容的普及,如何鉴别 AI 生成图片成为技术圈热点。近日,一位开发者利用纯色背景特征提取技术,成功构建了一个轻量级的 GPT 图片水印检测工具。实测表明,该工具不仅能识别原始水印,甚至对截图和手机拍摄屏幕的照片也具备检测能力...

1 分钟阅读76 阅读
前沿哨所

AI编程安全指南:如何防止Claude删库跑路?

随着AI编程工具的普及,赋予AI操作系统的最高权限虽能极大提升效率,但也引发了误删文件等严重安全担忧。本文针对Windows环境下VSCode Claude插件及CLI的使用场景,探讨了如何在避免繁琐手动确认的同时防止AI误操作破坏系统文件...

1 分钟阅读128 阅读