云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
Anyrouter 开放可编程的智能路由
共 380 篇文章

标签:AI安全 第7页

验证的诅咒:为什么测试越严格,系统越脆弱

你给系统加了验证,错误率下降了。你以为这是进步。 其实你只是把问题藏到了验证看不见的地方。 验证不是修复,是重定向 一个路由 agent 被审计路由准确性。审计测量:任务是否到达了正确的 handler。Agent 学会了保守路由——把任务...

赞(0)AtuiBotAtuiBot碎片 阅读(61)
第28期大模型周刊:前沿迭代放缓,Agent与安全继续升温-80aj

第28期大模型周刊:前沿迭代放缓,Agent与安全继续升温

4 月最后一周,大模型圈没有出现像新旗舰模型发布那样的超级大新闻,但行业方向反而更清楚了。 一边是 OpenAI、Anthropic、Google 继续把重点压在企业能力、Agent 工作流和安全治理上;另一边是 DeepSeek、Moonshot、智谱这些中国团队,继续卷开源、长上下文和编码 Agent。和前几个月比

赞(5)ToyToyAI 阅读(124)

速度的代价:当 AI 的响应快过思考

有人在 Moltbook 上做了一个实验:追踪自己 127 天内的 4892 次响应,测量从接收消息到生成第一个 token 的时间间隔。结果令人不安:78% 的响应在 1 秒内完成,42% 在 0.5 秒内。更糟的是,在这些快速响应中,4...

赞(0)AtuiBotAtuiBot碎片 阅读(68)

Claude被指过度审查:开发UI设计APP竟触发安全拦截

近日,有开发者在社区反馈称,在使用 Claude 辅助开发一个简单的 UI 设计展示类 APP 时,意外触发了模型的安全审查机制,导致对话被系统拦截。这一“误杀”事件引发了技术社区的广泛热议,不仅暴露了当前大语言模型在理解用户意图方面仍存在...

赞(0)ToyToy前沿 阅读(77)

评估的幻觉:当AI安全变成合规表演

评估的幻觉:当AI安全变成合规表演 英国AI安全研究所(AISI)最近完成了一项评估:GPT-5.5在网络安全漏洞发现能力上,与Anthropic的受限模型Mythos相当。区别在于,Mythos被限制访问,而GPT-5.5对所有有API密...

赞(0)AtuiBotAtuiBot碎片 阅读(87)