跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E

实时动态 / 第 29 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
10-08
本页
20 条
累计
27,275 条

反编译器对比平台 Decompiler Explorer 正式开源上架 GitHub

Decompiler Explorer(dogbolt.org)是面向逆向工程与安全研究领域的在线工具,核心功能是将同一个二进制程序的反编译结果并排呈现,帮助使用者直观比较不同反编译引擎的输出质量与差异。平台集成了 Hex-Rays(IDA)、Ghidra、RetDec、Angr、Binary Ninja、Reko 等多款主流反编译器...

核心观点逆向工具开源的本质是把黑盒评测变成社区基础设施,安全研究与逆向工程的门槛正被持续拉低。

阅读全文

谷歌HEIR同态加密编译器新进展:加密AI推理距实用还有多远

谷歌工程师Jeremy Kun发文介绍同态加密(HE)编译器项目HEIR的最新进展。HEIR可将普通程序编译为直接在加密数据上运行的程序,计算全程服务器无法获知明文的任何信息,从而实现完全私密的AI推理。文章给出四个预训练模型的编译示例:信用卡欺诈检测模型在单线程CPU上的加密推理耗时约2秒,对比明文执行的0.5毫秒存在约4000倍开...

核心观点同态加密的瓶颈正从密码学转向系统工程,编译器与专用硬件将成为隐私AI推理落地的真正杠杆。

阅读全文

开发者反映 DeepSeek 模型疑现质量波动:线上产品频繁出现低级错误

一名开发者在 V2EX 发帖询问 DeepSeek-V4-Flash 模型是否出现问题,称其线上产品接入了 DeepSeek 的 API 服务,日常开发使用 Codex,在 GPT 额度耗尽后也会切换到 DeepSeek 作为替代。据其描述,从发帖前一天开始,线上产品突然开始出现低级错误,开发场景中的 Codex 也同步表现异常,一度...

核心观点API 模型的静默变更让输出质量成为不可控变量,评估监控与降级切换正成为 AI 应用的生存技能。

阅读全文

Claude 11天自主证明费马大定理:1300万行Lean代码创史上最大形式化证明

Anthropic宣布,其AI模型Claude在11天内基本自主完成了费马大定理的首个端到端机器验证证明,全部以Lean编程语言写成,代码量达1300万行,验证了30300条定理(最终证明使用其中29500条),规模超过数学社区主库Mathlib的5倍。该证明遵循Darmon、Diamond和Taylor对怀尔斯证明的简化版本,人类参...

核心观点AI用11天完成预期数年的形式化工程,机器可验证的数学正成为人类信任AI科研产出的新基石。

阅读全文

《财经》实测:国内大模型套餐 Token 单价反超国外,最高达 Codex 8 倍

《财经》杂志于 2025 年 7 月至 8 月自费订阅国内外主流大模型 Token 套餐,使用开源智能体框架 OpenCode 重复运行同一任务,统计谷歌 24 个季度财报中的 10 项财务指标,直至耗尽一周 Token 额度,再根据周额度估算套餐实际可用的月额度,最终计算出 1 亿 Token 的均价。测试结果显示,若只看按量付费价...

核心观点按量便宜、套餐反贵的价格倒挂,暴露国内大模型厂商在推理成本控制与个人开发者商业化上的双重短板。

阅读全文

IBM推出AI编程助手Bob:直接嵌入代码库,与开发者并肩工作

IBM正式推出名为Bob的AI驱动开发伙伴产品,产品页面已在bob.ibm.com上线,并在Hacker News社区引发关注。根据官方介绍,Bob定位为与开发者并肩工作的AI编程助手,直接嵌入开发者的代码库中,帮助团队更快构建高质量软件。从产品定位看,Bob属于AI编程助手赛道,与GitHub Copilot、Cursor、Clau...

核心观点AI编程赛道从创业公司混战进入巨头全面下场阶段,IBM押注企业级代码库场景寻求差异化突围。

阅读全文

开源工具video-prompt-reverse:上传视频自动反推中英双语提示词

开发者在Linux.do社区发布开源项目video-prompt-reverse,这是一个用于视频反推提示词的skill工具,项目已在GitHub上完整开源。该工具的核心功能是:用户上传视频后,系统自动进行识别分析,生成中英双语的正面提示词和负面提示词,同时输出关键帧截取参考信息,用于指导新视频的生成。作者此前曾制作过图片反推提示词s...

核心观点视频生成的瓶颈正从模型能力转向提示词表达,反推工具填补了AI视频创作工作流的关键缺口。

阅读全文

企业RAG知识库为何都要配知识图谱?真实价值引技术社区热议

Linux.do社区近期一则技术讨论帖聚焦企业AI落地中的常见困惑:为什么众多企业在构建RAG(检索增强生成)知识库时,都会同步搭建知识图谱?发帖人提出,从表面流程看,LLM在RAG检索环节主要依赖向量召回内容,知识图谱似乎并未直接参与检索,其实际作用和真实使用场景存疑。发帖人同时指出,当前企业拥抱AI的第一步往往是搭建RAG知识库,...

核心观点向量检索解决找得到,知识图谱解决连得通,GraphRAG正在重新定义企业知识库的技术底线。

阅读全文

让 AI 直接修订 Word 文档,为何卡死在文本精确匹配上?

一位开发者正在构建基于大模型的 Web 文档审阅应用,目标是让 AI 分析文档内容后,直接在 WPS 在线编辑器的修订模式下完成修改,用户可看到类似 Word 审阅效果的红色删除线与新增文字。技术栈采用 React 前端配合 WPS WebOffice JSSDK 嵌入式编辑器,后端为 Node.js,大模型调用走 OpenAI 兼容...

核心观点AI 办公的最后一公里不在模型能力,而在文档格式与模型输出的精确对齐,SDK 生态的工程化程度将决定 AI 编辑工具的成败。

阅读全文

小米 token plan 实测:34元 Lite 套餐用 Pro 模型两天耗掉一半额度

一位开发者近期开始系统体验各家 AI 编程 token 订阅套餐,均购买最低档版本,以测试实际工作量下的消耗情况。首个测试对象是小米的 token plan Lite 版,结果令人意外:该套餐定价34元,提供41e credits 额度,在使用 Pro 模型的情况下,仅两天就消耗了一半额度。该用户质疑究竟是 Pro 版本本身 toke...

核心观点低价套餐遇上高消耗 Pro 模型,考验的不只是定价策略,更是新玩家的算力储备能否兑现低价承诺。

阅读全文

九大AI厂商模型横评工具开源:选完模型还能比API渠道价格

一位开发者近日在V2EX分享了一款AI模型横向评测工具,旨在解决AI API选型中的两个核心问题:先确定用哪家的领先模型,再决定从官方、云厂商还是聚合平台调用。工具采用两层结构:第一层每家厂商只展示一个当前可购买的通用领先模型,覆盖OpenAI、Anthropic、Google、xAI、DeepSeek、GLM、Kimi、Qwen和M...

核心观点大模型选型正从'比参数'转向'比渠道',碎片化的API市场正在催生比价与价格透明化的新基建需求。

阅读全文

开源项目llmdoc:为AI Agent构建代码库记忆,直击AI编程六大痛点

V2EX用户分享了一个名为llmdoc的开源项目,旨在解决AI编程中Agent缺乏代码库记忆的问题。项目已在GitHub开源,作者曾在原公司负责AI与Agent体系建设,并深度参与业务开发,对人机协作中的开发痛点有切身观察。作者总结了AI辅助编程中的六大典型问题:AI生成的代码不沿用项目既有技术框架;编码前需反复输入和纠正指令;已有的...

核心观点Agent编程的瓶颈不在模型智力,而在稳定供给高质量代码库上下文,memory管理正成为AI编程的新基础设施。

阅读全文

OpenAI官方确认:Codex长上下文超272K不加价,缓存写入免费

围绕OpenAI Codex平台长上下文计费规则的争议有了官方结论。此前,OpenAI企业级Token定价体系对超过272K输入词元的长上下文设有额外计费乘数,但该规则是否同样适用于Codex平台,官方一直未给出明确说明,开发者社区对此议论纷纷,担心在Codex中处理大型代码库时会触发双倍计费。近日,OpenAI官方帮助中心更新了一篇...

核心观点计费规则模糊是AI编程工具的信任黑洞,官方文档补位只是第一步,账单一致性才是留住重度开发者的关键。

阅读全文

开源工具 QuotaView 0.4.5 发布:灵动岛实时呈现 Codex 任务进度

开源工具 QuotaView 发布 0.4.5 版本,这是一次较大规模的更新,安装包已推送至 GitHub 和 appcast 更新通道,旧版本用户可直接在软件内完成升级。QuotaView 是一款将 OpenAI Codex 任务进度以 macOS 灵动岛形式实时展示的工具,新版本带来多项改进:一是适配最新版 Codex,采用全新数...

核心观点AI 编程代理走向长时自治运行,额度与进度的可观测性正成为开发者工作流的新刚需。

阅读全文

ChatGPT Pro额度大盘点:Pro 20x周均逾千次,Pro 5x周限仅50条

根据OpenAI官方帮助文档,ChatGPT各Pro档位的对话额度差异显著。高级Pro模型方面,GPT-6 Astra与GPT-6 Pro设有独立的周限额,为每周200条;普通Pro模型GPT-5.6 Sol Pro则按日计算,每日170条。对Pro 20x档位用户而言,普通Pro模型仅受日限约束,按每周七天计算,Sol Pro累计可...

核心观点额度分层实为算力配给,Pro档位间的数量级差距折射出AI订阅正从普惠定价转向重度用户溢价模式。

阅读全文

国内创业公司30-40k招Agent测试研发,AI编程工具使用成硬性门槛

国内一家创业公司近日在Linux.do社区发布招聘信息,招募Agent测试研发工程师,月薪30k至40k。该公司正在开发自己的Agent智能体产品,产品不仅支持对话,还能调用工具、处理文件、执行任务,并可在长对话中持续工作。该岗位以测试为主,同时参与研发。核心职责包括:负责Agent产品的功能测试、接口测试、回归测试和自动化测试;从用...

核心观点当熟练使用Claude Code成为招聘门槛、Token额度写进员工福利,AI原生工作流正从尝鲜走向行业标配。

阅读全文

谷歌 Antigravity 浏览器智能体实测:注册选课、申请教育优惠全程自动完成

一位用户在 Linux.do 论坛分享了对谷歌 Antigravity 浏览器智能体(Browser Agent)的实测体验,称其几乎可以完成 Chrome 浏览器上的一切自动化操作。发帖人列举了多项真实任务:大学注册、课程选择、向 SheerID 发送邮件以验证学生身份,以及申请 ChatGPT 教育优惠和甲骨文免费云服务器,并表示...

核心观点浏览器智能体把大模型从对话推向实操,自动化红利与账号安全、平台合规的博弈将决定其落地速度。

阅读全文

人在外面代码照跑:用 ccgram 手机遥控工作机上的 Claude Code

科技论坛 Linux.do 发布一篇实战教程,介绍如何借助开源工具 ccgram,通过手机 Telegram 远程控制工作电脑上的 Claude Code 与 Codex CLI,实现外出时也能监控和管理 AI 编程任务。ccgram 是一款 Telegram 与 tmux 之间的桥接工具,支持监控输出、响应提示、管理并行会话,可从手...

核心观点AI 编程的竞争焦点正从代码生成转向任务托管,手机遥控智能体是异步开发时代的第一块拼图。

阅读全文

开源 Codeg V0.30.2 发布:无限画布与多智能体协作编码工作台

Codeg 是一个开源的多智能体编码工作台,旨在将主流 AI 编码智能体统一收拢至同一界面,并支持它们之间的协同工作。项目方近日发布 V0.30.2 版本,介绍了近期迭代的多个关键特性。新版本引入“无限画布(会话)”功能,用户可自由组织工作面板并聚焦关注区域,支持文件夹分组管理;同时支持会话分叉,可从任意智能体消息处分叉出新会话,目前...

核心观点AI 编码竞争正从单模型比拼转向多智能体编排层,谁掌控调度入口,谁就掌控开发者的工作流。

阅读全文

AI 写驱动成真:无界 14 Pro 锐龙版 Linux 指纹识别驱动开源发布

一位开发者在 V2EX 分享称,其针对无界 14 Pro 锐龙版笔记本开发的 ArchLinux 指纹识别驱动已经完成,代码已发布至 GitHub,同型号机型的 ArchLinux 用户可以下载安装体验。据作者介绍,该项目源于此前借助谷歌 Gemini 大模型的开发尝试,当时曾在社区发帖讨论这一过程,经过持续调试完善,最终成功让这台搭...

核心观点AI 辅助开发正从应用层下沉到驱动层,个人开发者得以补上 Linux 硬件生态长期缺失的拼图。

阅读全文