揭秘经典柯达测试图集:分析显示其存在刻意筛选,非随机拍摄
一项针对经典的柯达图像测试集(Kodak suite)的最新GitHub研究通过PCA(主成分分析)指出,该数据集并非自然随机拍摄,而是经过了人为的刻意筛选。由于该数据集被广泛用于图像压缩和AI模型的基准测试,这一发现引发了关于算法评估准确性的讨论。研究揭示了历史数据集中潜在的人为偏见,强调了在AI训练与评估中审视数据源真实性的必要性...
阅读全文实时动态 / 第 448 页
追踪 AI、开源与工程领域的重要动态。
一项针对经典的柯达图像测试集(Kodak suite)的最新GitHub研究通过PCA(主成分分析)指出,该数据集并非自然随机拍摄,而是经过了人为的刻意筛选。由于该数据集被广泛用于图像压缩和AI模型的基准测试,这一发现引发了关于算法评估准确性的讨论。研究揭示了历史数据集中潜在的人为偏见,强调了在AI训练与评估中审视数据源真实性的必要性...
阅读全文近日,有技术社区用户反馈,AI聚合服务Antigravity在调用Google Gemini Pro模型时出现频繁故障。尽管用户确认账号区域及代理配置无误,但系统仍持续提示“服务器繁忙”或“流量过高”导致请求失败。值得注意的是,该平台上的Anthropic Sonnet模型目前运行正常。目前舆论对此原因尚存分歧,普遍猜测可能源于Goo...
阅读全文本文梳理了 2022 年至 2026 年 AI 交互模式的演变路径,从 Prompt Engineering 到 Context Engineering,再到当下的 Harness 时代。文章指出,每一波技术浪潮(如 RAG、Agent、MCP)的出现都是为了解决上一代的具体瓶颈,而非单纯的“升级”或替代。作者强调,AI 工具的演进构...
阅读全文一位大学生在使用AI(Claude/Gemini)辅助阅读学术论文时遭遇了实际痛点:虽然市面上有大量浏览器插件支持导出AI对话记录,但绝大多数工具在处理包含复杂数学推导的LaTeX公式时,无法进行可视化渲染,仅保留原始代码,导致导出内容不可读。这反映了当前AI对话导出工具在处理复杂排版技术上的缺失。该话题正在寻找能够完美支持数学公式渲...
阅读全文Apple 近日发布安全更新,修复了一个严重的 iOS 漏洞。在此之前,执法部门利用该漏洞,能够通过专用取证工具从 iPhone 中提取用户看似已“永久删除”的聊天记录和敏感数据。该漏洞绕过了设备内置的数据保护机制,使得即便用户手动清除了数据,仍面临被恢复的风险。苹果此次修复堵住了这一关键缺口,进一步强化了用户数据的隐私保护力度。
阅读全文近日,科技社区 Linux.do 发起了一项名为“DuckBenchmark”的纯视觉挑战,要求 AI 识别一只较为罕见的绿色返祖珂尔鸭。测试结果显示,绝大多数主流大模型(包括升级后的 Gemini 新版)纷纷“阵亡”,普遍将其误判为常见的野生绿头鸭。据反馈,目前唯一成功识别出该品种的竟然是去年的旧版 Gemini。这一测试不仅有趣,...
阅读全文美国国家教育统计中心(NCES)最新报告显示,13岁学生在2023年的阅读和数学平均成绩较2020年分别下滑4分和9分,与十年前相比更是暴跌7分和14分,创下数十年来最差记录。此次成绩下滑涵盖了所有层级的学生,尤其是数学成绩的退步幅度惊人。此外,经常缺课的学生比例翻倍,自主阅读兴趣降至历史最低。这一基础教育的'崩塌'现象,直接为未来科...
阅读全文拥有300万下载量的知名AI编程工具Roo Code团队正式宣布,将于5月15日停止运营其VS Code扩展、云服务及路由器套件。团队在致谢用户的同时抛出了极具争议的观点:“不相信IDE是编码的未来”。这一决定标志着其战略重心彻底从本地IDE插件转向云端Agent。官方推荐开源项目Cline作为替代方案,并引导用户关注其即将发布的全新...
阅读全文近期,部分Google AI Pro付费用户反馈,Gemini大模型服务出现严重的响应延迟问题。据实测数据显示,即便是使用响应速度较快的“Fast”模型,从用户发送提示词到模型开始生成回复,等待时间竟长达约一分钟,远超正常交互预期。这一现象引发了社区对于Google AI基础设施稳定性及算力资源分配的热议,甚至有用户怀疑是否存在人为限...
阅读全文Visual Studio Code 官方发布更新,正式宣布支持“自带语言模型密钥”功能。这意味着开发者不再局限于 GitHub Copilot,而是可以在 VS Code 设置中配置自定义的 API Key 和 BaseURL,直接使用 OpenAI、Azure 或其他兼容标准的第三方大语言模型。这一更新打破了厂商锁定,允许用户灵活...
阅读全文开发者近日在 V2EX 分享并开源了 iOS 应用 OpenVibble,该软件基于 claude-desktop-buddy 蓝牙协议,允许用户在无需实体开发板的情况下,通过蓝牙将 Claude Desktop 与 iPhone 连接。App 采用复古设计,复刻了宠物领养与交换功能,并利用 iOS 灵动岛实时展示 AI 状态。此外,...
阅读全文一种名为“Tokenmaxxing”的新风潮正在硅谷蔓延,初创公司CEO们竞相炫耀其在AI计算和模型Token上的巨额开销,视其为比雇佣人类更优越的扩张方式。Swan AI等公司宣称,他们单月在Claude等工具上花费超过10万美元,以此替代销售、法务和支持团队,追求“一人十亿估值”的终极目标。然而,这种疯狂背后存在隐忧:AI巨头自身...
阅读全文知名充电配件品牌Anker正式发布了首款自研定制芯片“Thus”,旨在将本地AI能力引入音频设备、移动配件及IoT产品。Thus芯片据称是全球首款采用“存算一体”架构的神经网络AI音频芯片。与传统芯片不同,它通过将计算直接在数据存储位置进行,大幅降低了功耗和延迟,使小型设备(如耳机)也能运行拥有数百万参数的复杂神经网络。该技术将首发应...
阅读全文本文深入探讨了“监控定价”的概念,即企业利用大数据和人工智能技术,通过收集用户的个人行为、浏览历史及消费习惯等隐私数据,构建详尽的用户画像。在这种模式下,商家利用严重的信息不对称,实施“千人千面”的个性化定价策略,旨在榨取消费者的最大支付意愿。文章分析了这种做法如何让消费者在不知情中被“大数据杀熟”,并探讨了相关的法律、伦理及经济影响...
阅读全文高性能代码编辑器 Zed 宣布推出“Parallel Agents(并行代理)”功能,允许用户在同一窗口内编排和监控多个同时运行的 AI Agents。新增的“Threads Sidebar”侧边栏让开发者能精准控制 Agents 对文件夹和代码库的访问权限,并保持 Zed 标志性的 120fps 流畅体验。此次更新还优化了界面布局,...
阅读全文近期,技术社区关于 AI 编辑器 Cursor 的讨论聚焦于其“缺乏主见”的现象。多位开发者反馈,当要求 Cursor 修复多个 Bug 或执行连续任务时,它往往仅完成第一项便主动暂停,弹窗询问“是否继续处理下一项”。这种“点到为止”的行为导致开发流程被打断,用户必须不断发送指令才能推动任务进行。该问题在 Cursor 的不同底层模型...
阅读全文据科技社区消息,字节跳动旗下的火山引擎在开发者服务层面进行了重要更新。其 Coding 方案已率先接入了智谱 AI 的 GLM-5.1 模型以及 MiniMax 的 M2.7 模型。这一动作显示出云服务商在整合国内头部大模型方面的激烈竞争。与此同时,京东的 AI 服务也已上线 GLM-5 等模型,但有用户反馈其在高峰期存在拥堵情况。这...
阅读全文近日,部分开发者在使用 VSCode 的 Claude Code 扩展配合第三方 API 路由服务时,频繁遭遇 503 连接错误。经社区验证,此问题并非 API 完全不可用,而是由于扩展版本滞后导致的兼容性故障。解决方案非常简单:用户需先在终端更新 Claude Code 核心工具,随后更新 VSCode 内的扩展插件,即可恢复正常调...
阅读全文智谱AI近期因调整服务策略引发用户强烈不满。争议的核心并非单纯的价格上涨或算力成本,而是其运营策略被指缺乏诚信。有用户指出,智谱在3月底诱导老用户补差价开启自动续费,却在不足一个月后的4月突然改变规则。这种被用户称为“先骗后杀”的行为——即在明知即将关停或调整服务的情况下仍收割续费——引发了广泛的愤怒与信任危机,也折射出AI行业在商业...
阅读全文Palantir 近期发布的一份类似宣言的文件,主张硅谷有“道德义务”为西方国家(特别是五角大楼)制造 AI 武器。文章严厉批评了这种观点,指出这实质上是科技寡头将商业利益包装成国家战略,旨在制造政府对 AI 的依赖。同时,文中还提到 Anthropic 与美国国家安全局(NSA)的合作,揭示了 AI 巨头正更深地卷入军事与监控网络,...
阅读全文