跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E

实时动态 / 第 11 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
10-08
本页
20 条
累计
27,264 条

同一任务实测国内外 AI:国内模型擅自加配色,Claude 免费额度还原最完美

V2EX 用户分享了一次 AI 使用体验:作者将一个简单任务——把约14张截图按文件名顺序拼接转换为可编辑的 Word 或 PDF 文件——分别提交给多款 AI 工具测试。作者最初使用免费的 workbuddy,因其生成速度较慢,又将相同任务提交给其他常用 AI 进行对比。测试结果显示,国内外模型表现差异明显:作者在提示词中只要求“按...

核心观点AI 的可信度不在于做得更多,而在于严格遵循指令;过度热心的隐藏调优正在消耗用户对国产模型的信任。

阅读全文

开源项目AgentDeck:手机统一远程操控Claude Code、Codex等AI编程智能体

开发者在V2EX分享开源项目AgentDeck,这是一款手机端及浏览器插件工具,用于远程操作电脑上正在运行的AI编程智能体,支持Claude Code、Codex、Cursor、GitHub Copilot、Qwen Code等主流工具,基于ACP(Agent Client Protocol)协议构建。与各家AI编程工具自带的远程功能...

核心观点AI编程Agent长任务化催生移动监看需求,协议标准化正在为第三方编排工具打开生态切口。

阅读全文

AI驱动的一周新闻自动分析:多源聚合工作流分享,两版报告公开投票

一名开发者在Linux.do社区分享了基于AI的每周新闻分析实践。该方法以BBC中文、FT中文网、法广RFI、纽约时报、澎湃新闻、爱范儿、少数派、人民日报、求是网、21世纪经济报道、央视新闻等中外媒体作为新闻源,先由AI对每天的新闻进行汇总分析,一周后再由AI基于全周内容生成综合分析报告,本次分享覆盖2026年9月20日至9月27日的...

核心观点当AI能完成新闻汇总,人的核心价值转向prompt设计与质量把关,信息处理正从「阅读」转向「调校」。

阅读全文

用 Facet 测试 WebGPU 数据布局:把 GPU 内存对齐变成可验证的契约

WebGPU 作为新一代图形与通用计算 API,要求 CPU 侧传入 GPU 的数据(如 uniform buffer、storage buffer)严格遵守 WGSL 着色器语言定义的内存布局规则,包括字段对齐与填充。一旦 Rust 结构体的实际内存排布与着色器预期不一致,轻则渲染结果错乱,重则触发验证层报错,且此类问题通常难以定位...

核心观点GPU 编程最隐蔽的 bug 藏在对齐缝隙里,把内存布局变成可测试的契约,是类型系统驯服异构计算的关键一步。

阅读全文

Codex Desktop 升级后 GPT-6.1 Sol 模型消失?一行配置即可找回

Codex Desktop 升级至最新版本后,部分通过 CPA 接入的用户发现模型列表异常:GPT-6.1 Sol 不再显示,此前可见的 GLM、DeepSeek、Qwen 等第三方模型也全部消失,仅剩少数官方模型。经排查,CPA 的 /v1/models 接口返回正常,本地 models_cache.json 缓存文件中也包含这些模...

核心观点模型列表的静默收紧,揭示客户端正从中立工具演变为官方模型的分发入口,第三方接入的维护成本将持续上升。

阅读全文

快手可灵4.0发布:实测对比字节Seedance 2.5,附提示词案例集

快手旗下AI视频生成模型可灵(Kling)4.0正式发布,社区用户随即整理了可灵4.0与字节跳动Seedance 2.5的实测对比案例,展示两类模型在同一提示词下的生成效果差异,对比内容已在kingvid.app网站公开发布。此外,该用户还整理了可灵4.0的Prompt(提示词)案例集合,收录了大量可直接复用的视频生成提示词示例,并在...

核心观点视频生成竞赛已从模型能力比拼转向提示词语料与社区生态之争,开源案例集正在成为新的护城河。

阅读全文

Codex接入sub2api不显示最新模型?两行配置即可解决

近日,Linux.do社区有开发者分享了OpenAI命令行编程工具Codex在接入sub2api中转服务时不显示最新模型的解决方法。该问题表现为Codex连接第三方API中转站后,模型列表无法同步显示最新上线的模型。经排查,根本原因在于Codex检测到配置文件中存在experimental_bearer_token字段后,会自动切换至...

核心观点AI编程工具的竞争已从模型能力延伸到接入体验,兼容性细节正决定生态渗透的速度与广度。

阅读全文

Codex 频现容量不足报错,开发者转投 opencode + DeepSeek 组合

近日,V2EX 有开发者发帖吐槽 OpenAI 旗下 AI 编程服务 Codex 的使用体验。该用户订阅了 Codex Pro 5X 档套餐,页面显示剩余用量高达 95%,却频繁弹出“Selected model is at capacity”(所选模型容量已满)的提示,导致开发流程反复中断,用户抱怨“用量提示不断刷屏,闹麻了”。无奈...

核心观点当付费订阅连基本容量都无法保障,可自由更换模型的开源工具组合正在加速瓦解闭源 AI 编程服务的护城河。

阅读全文

Qwen小模型本地翻译横评:16G显存可跑4B模型,LM Studio部署避坑指南

Linux.do社区用户发布了一篇关于本地部署Qwen系列小模型执行翻译任务的测评文章。作者围绕准确性优先的原则,设计了客观与主观相结合的评价体系:客观部分将各模型的中译英结果交由GPT评分,主观部分则公开全部翻译内容供读者自行比对语言风格。测试在9700X处理器、32G内存、5060Ti 16G显卡、Windows 10环境下进行,...

核心观点小模型加本地部署正把AI翻译从云端订阅拉回个人电脑,隐私、成本与可控性成为开源生态对抗云服务的新筹码。

阅读全文

Vibe Coding 实战案例:开发者开源修仙游戏《万界道友》

V2EX 分享发现板块近日出现一则开发者帖子,作者展示了自己通过 Vibe Coding(氛围编程)方式开发的修仙题材游戏《万界道友》。据作者介绍,该项目经过多轮迭代,已具备较为完整的玩法体系,包括捕捉灵兽、战斗、炼器、道具系统、玩家 PK 以及合宠等模块。作者表示,这款游戏适合上班族在工作间隙休闲游玩。项目已在 GitHub 上开源...

核心观点Vibe Coding 让单人开发者具备完整游戏交付能力,独立开发的产品门槛正被 AI 快速重写。

阅读全文

AI参与动漫影视商业制作引热议:提升作品质量还是挤压画师生存空间?

Linux.do论坛近日出现一篇讨论AI参与动漫、影视、游戏CG等商业内容制作的帖子,引发关注。发帖人指出,AI在绘画和视频生成领域进步迅速,并表明支持AI参与商业制作的态度。其理由是:动漫影视行业高度消耗人力、时间和资金,一部作品中大量过渡镜头、背景和重复性内容会占用过多制作资源,若AI能承担这部分工作,制作组可将节省的资源集中投入...

核心观点AI进入影视制作的真正争议不在工具本身,而在于节省的成本流向作品质量提升还是资本口袋。

阅读全文

AI 一句话生成 Minecraft 建筑,开发者推出 BlockDreamer 工具

一位开发者在 V2EX 分享了自己开发的 AI 生成 Minecraft 建筑工具 BlockDreamer。作者表示,自己一直玩不好开放世界类游戏,根本原因在于缺乏空间想象和规划能力,看到别人从零搭建起整座城市或庞大工程十分羡慕,而轮到自己动手,盖出来的永远是个方盒子。为此,他近期研究了 AI 相关能力,开发出这款工具,用户只需用自...

核心观点AIGC 正从文本图像迈向三维空间生成,游戏创作门槛的坍塌将重塑玩家 UGC 共创生态。

阅读全文

skillsgist 开源更新:基于 Cloudflare 的轻量私有 Agent Skills 仓库

开发者为解决团队内部共享非公开 Agent Skills 的需求,自研并开源了 skillsgist,一款部署在自有 Cloudflare 账号下的轻量级私有 Agent Skills 仓库,采用 MIT 协议。部署仅需一个 Worker、一个 D1 和一个 R2,默认配置即可在 Workers 免费版运行,提供 Deploy to ...

核心观点当智能体技能从个人技巧变成团队资产,私有化仓库将像代码托管一样成为基础设施的标配。

阅读全文

OpenAI 发布全天候智能体 Dot:云端常驻运行,可连接 4000+ 应用

OpenAI 于 9 月 29 日正式发布新产品 Dot,定位为全天候在线的智能体。据官方介绍,Dot 能够了解用户在意的内容,持续替用户执行任务,将重要工作从用户手中接管过来,标志着 OpenAI 的产品形态从对话式助手向全天候个人代理延伸。Dot 由 GPT-6 Astra 模型驱动,并配备独立的云端电脑作为运行环境。在长期使用过...

核心观点AI 竞争焦点正从对话模型转向全天候代理,谁能接管用户的数字劳动,谁就掌握下一代流量入口。

阅读全文

开发者推出RPCHub:覆盖500+条链的Web3 RPC性能检测与调试工具

一位Web3开发者在V2EX分享了自己开发的chainlist扩展工具RPCHub(rpchub.top),旨在解决开发过程中RPC节点不稳定的问题。据介绍,Web3开发者经常遇到RPC节点响应异常,交易发不出去或长时间无响应,而传统Chainlist只能检测RPC能否连通,连接成功不代表速度快,也不代表节点在正常出块。RPCHub的...

核心观点链上开发的稳定性取决于最弱一环,把RPC'能连'与'能用'区分开,正是多链时代被忽视的基础设施缺口。

阅读全文

OpenAI新定价页现Codex速度分层:200美元档标“更快”,低价档疑似面临降速

近日,有网友浏览ChatGPT新定价页面时发现,不同订阅档位对Codex编程智能体的速度描述存在明显差异:月费200美元的Pro档位标注“faster Codex”(更快的Codex),月费500美元的Ultra档位则标注“fastest Codex”(最快的Codex)。发帖者认为,500美元档的“最快”尚可理解,因为该档位提供了u...

核心观点当算力成为稀缺资源,“速度”正取代“功能”成为AI订阅分层的新货币,开发者体验开始被明码标价。

阅读全文

开源工具 Corral:彻底杀死 AI Agent 启动的每一个失控进程

一位曾在 AI Agent 后端实习的开发者发现,Agent 运行 tail -f 或后台任务后退出时,这些进程不会被终止,沦为残留进程。他调研后发现 Claude Code 也存在同类问题:其 Bash 工具在会话结束后不清理后台进程,另一处缺陷则是超时机制向整个进程组发送 SIGTERM,结果误杀 Claude Code 自身。多...

核心观点AI Agent 越自主执行命令,进程治理与沙箱边界这类脏活就越成为比模型能力更先暴露的基础设施短板。

阅读全文

OpenAI发布GPT-6.1 Sol:性能逼近Astra,价格仅为其五分之一

OpenAI正式推出GPT-6.1 Sol模型,即日起面向ChatGPT Work与Codex内所有Plus、Pro、Business、Enterprise及Edu用户开放。该模型性能接近GPT-6 Astra,但标准词元价格仅为后者的五分之一。API定价为每百万输入token 2美元、每百万缓存输入token 0.10美元、每百万输...

核心观点低价模型、常驻智能体与企业生态三线并进,AI竞争正从模型性能转向定价权与落地生态的全面争夺。

阅读全文

Anthropic 评价 GLM-5.3:网络攻击能力达前沿水准,安全护栏 1200 美元即可破解

Anthropic 发布对智谱 GLM-5.3 模型的评估报告,从能力与安全两个维度给出罕见的外部实验室评价。报告指出,GLM-5.3 在网络安全领域能力突出,能够自主构建端到端的网络攻击利用链(exploit),能力达到全球前沿模型水准,这一评价本身即是对中国模型能力的重要背书。然而与其他前沿模型不同,GLM-5.3 发布时未配备有...

核心观点当 1200 美元就能移除前沿模型的安全护栏,AI 安全竞争已从提示词防御转向权重治理与国家层面的审查博弈。

阅读全文

Claude突发大范围故障:网页版、Claude Code与API服务同时中断

Anthropic旗下AI服务Claude于9月29日发生大范围故障,官方状态页先后发布多条更新,确认claude.ai网页版及桌面、移动端应用、Claude Code、Claude Cowork以及Claude API均出现错误率升高的情况。故障期间,用户可能遇到请求失败、对话加载或发送出错,部分用户被要求重新登录,重试操作有时可以...

核心观点当AI编程工具深度嵌入开发者工作流,一次故障就是全行业的生产力停摆,AI服务可靠性已成新的基础设施命题。

阅读全文