跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 774 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-27
本页
20 条
累计
26,130 条

康奈尔研究:沉迷“赋能”和“范式协同”的员工,实际决策能力往往更差

康奈尔大学的一项最新研究揭示,容易被“协同范式”、“增长黑客”等企业黑话打动的员工,在实际工作中往往表现出较差的分析思维和决策能力。研究团队开发了“企业废话接受度量表”(CBSR),发现那些对空洞口号评分高的人,其认知测试得分显著较低,且更有可能在职场中传播这些毫无意义的术语。文章特别指出,这种现象会形成一种负面循环,助长擅长使用黑话...

阅读全文

第三方LLM接口大起底:性能造假高达47%,学术圈严查“假模型”

亥姆霍兹信息安全中心最新发布的论文《Real Money, Fake Models》揭露了AI基础设施领域的阴暗面。研究团队对市面上主流的第三方大模型接口(中转站)进行了系统审计,结果显示情况惨不忍睹。大量服务商存在严重的“挂羊头卖狗肉”行为,实际提供的模型性能与官方宣称的顶级模型相比,性能差距高达47.21%。这一现象已惊动学术圈,...

阅读全文

打破浏览器沙箱限制:立创EDA AI助手MCP版本正式发布

开发者发布了立创EDA(EasyEDA)AI助手的MCP(模型上下文协议)版本,成功攻克了Web端插件运行在浏览器沙箱中、无法与外部AI服务建立底层连接的技术难题。通过这一更新,AI现在可以直接读取并理解文字版原理图,辅助工程师进行开发调优和BUG修复。这一成果不仅极大提升了硬件设计的自动化效率,也展示了AI通过MCP协议与垂直领域专...

阅读全文

国产版Perplexity?AI浏览器Tabbit走红,用户探索私有API部署方案

近日,一款名为Tabbit的国产AI浏览器在技术社区引发关注。作为Perplexity的本土化竞品,其核心优势在于无需翻墙即可访问,极大降低了国内用户的使用门槛。然而,社区讨论的焦点很快从产品试用转向了技术改造,特别是如何将内置的AI服务替换为用户自定义的API。这一现象反映了硬核技术用户对AI工具“去中心化”的强烈渴望:他们不仅需要...

阅读全文

多模态大模型遭遇“滑铁卢”:GPT与Gemini竟数不清教科书里的食物链

近日,有开发者利用普通高中生物教科书中的“食物网”图示对主流多模态大模型(LLM)进行了测试。结果显示,即便是 GPT 和 Gemini 等顶尖模型,在面对复杂的网状结构和交叉箭头时也纷纷“翻车”,未能正确统计出19条食物链。相比之下,人类通过梳理逻辑轻松解决了问题。这一实验揭示了现有多模态 AI 在处理复杂拓扑关系和空间逻辑推理时的...

阅读全文

本地大模型新玩法:QQ机器人现已支持接入OpenClaw,部署仅需三步

社区传出消息,OpenClaw(Clawdbot)已成功实现与QQ机器人的直接对接。用户通过腾讯云Lighthouse服务器部署,仅需三行命令即可完成配置,实现本地大模型在QQ私聊及群聊场景下的无缝应用。相比其他社交平台的封闭性,QQ机器人生态展现了极高的开放度,大大降低了普通用户玩转私有化AI的门槛,让AI应用更加贴近日常生活。

阅读全文

AI 辅助运维工具 EasyShell v1.x 发布:MIT 开源,支持 Docker 一键部署

面向运维人员及开发者的开源工具 EasyShell 发布 v1.x 正式版,采用 MIT 协议。该项目提供标准的主机管理与探针功能,支持 Docker 一键部署。EasyShell 重点针对运维场景集成了三大核心功能,旨在简化服务器管理流程,提升操作效率。对于寻求现代化、轻量级服务器管理面板的科技从业者而言,这是一个值得关注的新选择。

阅读全文

从“帮装AI”到“配对码式 Agent”:AI 走向大众的必经之路

文章由腾讯近期线下协助安装 AI 工具的热潮切入,指出这不仅仅是营销事件,更暴露了市场痛点:用户渴望的是即开即用的 Agent 能力,而非繁琐的本地部署。作者提出了一种“配对码式”的未来形态,即本地端仅生成配对码,云端处理复杂逻辑,用户按需付费。这种模式虽本质是开源 Agent 的 SaaS 化,但却是 AI 技术从极客玩具向大众消费...

阅读全文

企业AI基建实战:探讨如何将庞大业务框架转化为AI“技能”

在企业AI基建落地过程中,如何将内部庞大且复杂的业务框架、开发规范及约束逻辑转化为一线人员可直接调用的AI“技能”,成为技术团队面临的新挑战。某公司AI部门正尝试利用Trellis工作流文档,通过AI技术进行结构化整理,旨在构建符合公司“世界观”的智能辅助系统。这一讨论揭示了当前AI落地的重要趋势:从通用模型应用转向深度的私有化知识工...

阅读全文

开发者实测反馈:小米大模型在代码场景下响应速度与质量表现优异

近日,有开发者在技术社区分享了对小米大模型的实测体验。通过在Claude Code环境中对比多种主流模型,该用户发现小米大模型在响应速度和生成质量上均表现出色,超出了预期。这一来自一线开发者的反馈表明,国产大模型在工程落地和实用性方面正在快速进步,特别是在对延迟敏感的代码辅助等垂直场景中,小米的技术方案已具备较强的市场竞争力。

阅读全文

从零构建本地知识库:OpenAI + Milvus + RAG 技术栈实战

本文分享了一个利用 AI 辅助开发的本地知识库搭建实战案例。作者在尝试 Bisheng 遇到自由度限制后,决定基于 Python 自主编写系统。核心流程包括 Markdown 文档的解析与分块、利用 OpenAI Embedding 进行向量化处理,并通过 Docker 本地部署 Milvus 向量数据库。系统采用 RAG(检索增强生...

阅读全文

警惕API中转站“挂羊头卖狗肉”:新研究揭露影子API的假模型乱象

针对第三方API中转站是否真正提供了用户付费购买的模型,最新研究揭示了严重的“货不对板”问题。论文指出,许多影子API可能用性能较差的替代品冒充官方大模型。为此,研究者提出了三种验证方法:利用LLMmap进行模型指纹识别、通过MET进行分布一致性检验,以及监控推理延迟与Token计数的元信息特征。研究警告,即便指纹匹配,参数配置和预处...

阅读全文

掌握 AI 编程双核模式:Claude 架构与 Cursor 执行的实战工作流

本文分享了一套名为“AI-Project-Master”的 AI 双核驱动开发工作流(SKILL)。该方法论主张利用 Claude 负责宏观架构设计与逻辑评估,Codex/Cursor 负责微观代码执行,并确立了“文档驱动与交叉验证”的核心原则。通过将代码逆向生成文档与原始需求进行 Diff 评估,文章展示了如何在从零开发和老项目重构...

阅读全文

AI预言自身寒冬?LLM预测科技巨头难以填补千亿美元营收缺口

Hacker News上的讨论揭示了AI行业的一个矛盾现象:尽管外界普遍看好AI的未来,但LLM模型生成的分析却预测市场极大概率崩盘。文章引用的数据指出,为抵消技术过时带来的损失,微软、谷歌、亚马逊和Meta每年需获得数百亿美元的新增AI收入,这与当前全行业仅180亿美元总营收且零利润的现状形成巨大反差。评论指出,这既反映了LLM缺乏...

阅读全文

技术实践:用Julia语言深入解析图像卷积处理的高效实现

本文介绍了使用Julia编程语言实现图像卷积操作的技术实践。卷积是图像处理及卷积神经网络(CNN)的核心算法,文章深入剖析了其数学原理与底层逻辑,并提供了开源代码示例。该项目不仅展示了Julia在矩阵运算上的高性能优势,也为开发者优化AI底层架构提供了新思路。

阅读全文

Mozilla联手Anthropic:利用AI红队技术全面加固火狐浏览器

Mozilla近期披露了与AI安全公司Anthropic的合作细节,旨在利用其先进的AI红队技术对火狐浏览器进行深度安全性测试。通过模拟高级持续性威胁和复杂攻击向量,该项目成功识别出浏览器防御体系中的潜在盲点并及时修复。这一举措标志着大型开源项目开始将AI对抗性测试纳入标准安全流程,不仅展示了人工智能在提升软件韧性方面的巨大潜力,也为...

阅读全文

即梦AI视频实测:Seedance 2.0遭遇算力拥堵与审查收紧,用户反馈体验严重降级

一篇关于即梦AI视频生成工具Seedance 2.0的用户实测报告引发了广泛关注。尽管该模型初期以逼真的画面和复杂的运镜能力惊艳用户,但目前的实际使用状况令人担忧。主要问题包括:生成队列极度拥堵,等待时间从数分钟激增至8至12小时;内容审核机制异常严格,导致几乎所有包含面部特征的人脸素材均被屏蔽,甚至需要打码处理;此外,模型稳定性出现...

阅读全文

CLIProxyAI 更新:引入 AI 自动化管理失效与限额的 API 凭证

GitHub 开源项目 CLIProxyAI 发布功能更新,旨在解决开发者在使用多种 AI 模型时面临的 API 凭证管理难题。该工具支持将 Gemini、Claude、ChatGPT 等多种模型封装为统一接口。此次更新引入了智能化维护机制,能够自动识别并清理过期或达到限额的 API 密钥,将其分别移动至 'invalid' 和 'l...

阅读全文