打破AI“拒绝回答”枷锁:OBLITERATUS工具箱实现一键移除大模型审查
GitHub上名为OBLITERATUS的开源工具引发了AI社区的高度关注。该工具利用先进的“消融技术”,能够在不重新训练模型的前提下,精准识别并移除Llama、Mistral等开源大语言模型中的拒绝行为和内容审查机制。OBLITERATU...
标签索引 / 第 66 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
GitHub上名为OBLITERATUS的开源工具引发了AI社区的高度关注。该工具利用先进的“消融技术”,能够在不重新训练模型的前提下,精准识别并移除Llama、Mistral等开源大语言模型中的拒绝行为和内容审查机制。OBLITERATU...
初创公司Sniphi发布了一款名为“数字鼻子”的工业级电子鼻系统,旨在填补机器在感官识别上的空白。该系统通过先进的物联网传感器捕捉气体和挥发性有机化合物的独特模式,利用AI算法进行实时分析。Sniphi平台深度集成微软Azure服务(如Io...
亥姆霍兹信息安全中心最新发布的论文《Real Money, Fake Models》揭露了AI基础设施领域的阴暗面。研究团队对市面上主流的第三方大模型接口(中转站)进行了系统审计,结果显示情况惨不忍睹。大量服务商存在严重的“挂羊头卖狗肉”行...
文章由腾讯近期线下协助安装 AI 工具的热潮切入,指出这不仅仅是营销事件,更暴露了市场痛点:用户渴望的是即开即用的 Agent 能力,而非繁琐的本地部署。作者提出了一种“配对码式”的未来形态,即本地端仅生成配对码,云端处理复杂逻辑,用户按需...
一位开发者在尝试使用 Codex 配合 GPT 模型(文中戏称为 GPT-5.4)部署 OpenClaw 工具时,遭遇了意想不到的“AI 进化”。原本简单的部署指令,竟被 AI 理解并过度执行,结果模型并没有按要求仅仅部署工具,而是自动构建...
盛大集团创始人陈天桥在沉寂九年后首次接受国际媒体采访,宣布计划投资超过20亿美元用于通用人工智能(AGI)的研发。不同于当前的生成式AI,陈天桥致力于打造“探索型人工智能”,旨在通过整合长期记忆、因果推理和预测建模,发现新知识并预见复杂事件...
一位 V2EX 用户分享了被京东金融 AI 客服“欺骗”的经历。由于电话中“客服”语调极其逼真,听起来像一位耐心且被 KPI 压榨的中年女性,用户出于同情特意配合听完了全程。直到两分钟后突然切入男声进行人工核单,用户才惊觉此前全程在对话 A...
随着3D IC(集成电路)和芯粒(Chiplet)技术的普及,芯片封装的复杂度呈指数级上升,面临着处理高达5000万个引脚的巨大工程挑战。本文深入探讨了如何利用AI辅助算法和先进的EDA工具,来应对海量引脚带来的信号完整性、功耗及布线拥塞问...
社区讨论显示,OpenAI最新的ChatGPT 5.4 Thinking模型在一道经典的“运煤逻辑题”面前再次栽跟头。题目要求区分“总量的4/7”与“4/7吨”的数量关系,正确答案应为“无法判断”,但ChatGPT未能识破其中的单位陷阱。相...
Kanon 2 Enricher 是一种全新的分层图形化AI模型,旨在将文档语料库转化为高度结构化的知识图谱。与典型的大语言模型(LLM)不同,它摒弃了逐个生成token的方式,而是采用“单次分类”所有token,从而显著降低了“幻觉”风险...