跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E

实时动态 / 第 19 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
10-08
本页
20 条
累计
27,269 条

8×H200部署DeepSeek-V4.1-Flash遇阻:并发8即卡死,GPU满载却零输出

一名开发者在Linux.do论坛发帖求助,称其在8张NVIDIA H200 GPU(2TB内存、模型存放于本地NVMe)上通过vLLM nightly版本部署DeepSeek-V4.1-Flash时遭遇严重性能问题。启动配置包括8路张量并行、1048576最大上下文长度、64并发上限、前缀缓存与推测解码等参数,并挂载了CPU卸载连接器...

核心观点GPU满载却零输出,暴露的正是超长上下文时代的调度瓶颈——算力不再是短板,推理架构设计才是。

阅读全文

Claude Opus 5.5发布:性能登顶且定价更低,订阅配额全面上调

Anthropic正式推出新一代旗舰模型Claude Opus 5.5,该模型在多项基准测试中登顶,同时定价较前代进一步下调。伴随新模型发布,Anthropic同步调整了订阅配额政策:Claude Pro、Max、Team及企业用户的5小时使用额度上限提高20%。由于Opus 5.5定价更低,用户选用该模型时,5小时额度和周额度还会额...

核心观点大模型竞争已从跑分转向单价与配额,Anthropic以降价加放量直接抬升订阅性价比,压制竞争对手。

阅读全文

AI对话越聊越跑题?为什么第一个回答往往价值最高

近日,Linux.do论坛一位用户分享了使用AI的体验:无论是网页对话还是编程场景,同一对话中第一个回答的价值往往最高,最能针对问题本身给出精准回应。该用户指出,虽然后续可以继续追问细节,但随着对话轮次增多,AI会逐渐偏离主题或抓不住重点。这一观察源于另一个帖子的启发:对于对话串中的第N个问题,此前全部上下文实际上构成了该问题的提示词...

核心观点上下文越长不等于回答质量越高,管理对话上下文的能力正成为AI使用者的核心竞争力。

阅读全文

OpenAI宣称攻克百万美元数学难题,数学家质疑:解错了纳维-斯托克斯问题

两周前,OpenAI宣称其内部大模型生成了纳维-斯托克斯问题的证明,有望获得克雷数学研究所的100万美元奖金。该成果一度被视为人工智能冲击基础数学研究的标志性事件,同时引发了数学界对AI公司竞赛式涌入学术领域的担忧。然而随着讨论深入,一项新争议浮出水面:OpenAI可能并未解决"正确"的纳维-斯托克斯问题。其证明所依赖的方法被许多专家...

核心观点大模型擅长在问题表述的缝隙中寻找解,但数学突破的价值最终取决于是否回答了真正的问题。

阅读全文

黑客组织ShinyHunters宣称攻破FBI,窃取全员员工敏感数据

知名黑客组织ShinyHunters宣称攻破多个FBI相关服务,窃取了所有FBI员工及申请者的数据。该组织代表向404 Media透露,数据包括FBI探员的姓名、住址、电话号码及配偶信息。404 Media获得的样本包含5000名FBI员工的个人数据,经开源情报工具OSINT Industries和泄露数据核查工具Darkside验证...

核心观点零日漏洞叠加政府云失守表明,再强势的执法机构也难挡供应链级攻击,黑客动机从牟利转向威慑更让数据泄露风险失控。

阅读全文

标价便宜实付更贵:o5.5 Token效率不敌Astra,前端审美难定模型胜负

近日,Linux.do社区用户对比了o5.5与Astra两款大模型的实际使用成本与效果。从API标价看,o5.5的输出单价约为Astra的五分之二,看似便宜很多,但由于o5.5的Token效率明显更低,实际任务中花费的金额接近Astra的两倍,效果却并未更好。用户指出,近期流传的对比案例多集中于前端界面审美,而审美恰是Claude系列...

核心观点大模型竞争正从标价战转向效率战,Token效率才是决定实际成本与产业落地价值的隐藏变量。

阅读全文

Claude Pro 额度实测:5小时窗口约用1亿 tokens,每周可用约7亿

Linux.do 论坛用户发布了一份关于 Claude Pro 订阅额度的实测数据。测试者在单次对话中持续使用 Opus 模型,直至耗尽一个 5 小时滚动窗口的全部额度,此时系统显示已消耗当周总限额的 14%。据此推算,在保持提示缓存命中的理想条件下,Claude Pro 订阅每周最多可使用约 7 亿 tokens,对应每个 5 小时...

核心观点配额黑箱已成 AI 订阅的隐性定价机制,社区实测数据是用户弥合信息不对称的主要途径。

阅读全文

Cursor性价比遭质疑:开发者为何不直接用Claude Code和Codex?

近日,Linux.do论坛上有开发者发起讨论,质疑Cursor的性价比。发帖人称,看到不少用户在Cursor上几天内花费数百美元,却不去选择Claude Code的20x订阅方案或Codex,后两者可以直接畅用顶级模型,因此疑惑Cursor是否存在值得如此投入的独特价值。该话题引发社区讨论。Cursor作为基于VS Code分叉的AI...

核心观点当模型厂商亲自下场做编程工具,中间层的套壳红利正快速蒸发,体验壁垒终究难敌成本壁垒。

阅读全文

复刻苹果液态玻璃质感:开发者开源 AI 语音输入法 LiquidType

近日,一位开发者在 V2EX 分享了自己开源的 AI 语音输入法项目 LiquidType,源代码已在 GitHub 上公开。据作者介绍,开发这款产品的初衷是自己非常喜欢 macOS 上的 Liquid Glass(液态玻璃)视觉效果,但市面上目前缺少外观足够出色的 AI 语音输入产品,于是决定亲手打造一个,将 Apple 最新的设计...

核心观点AI 语音输入的竞争焦点正从识别精度转向体验设计,视觉质感成为独立开发者差异化突围的新变量。

阅读全文

JEV 模型刷屏背后:开发者推出免费 Playground 与资源集合站

近日,一种名为 JEV 的新型模型在技术社区引发广泛讨论,有开发者趁热度上线了一个 JEV 试玩场与资源集合站,目前对所有用户免费开放。据作者介绍,JEV 与普通大语言模型的工作方式存在根本差异:普通 LLM 接到请求后会直接生成一段自由文本,而 JEV 不直接输出文字内容,而是针对几个预设选项返回各自的概率分布。这种机制使 JEV ...

核心观点JEV 用放弃自由生成换取速度与成本,折射出 AI 模型正从通用能力竞争走向场景化、轻量化分工。

阅读全文

Anthropic开源代码迁移工具包:曾助Bun完成百万行Zig转Rust

Anthropic在GitHub开源了名为code-migration-kit-with-claude-code的代码迁移工具包,其中包含用于大规模编程语言迁移的提示词、模板和脚本,需配合Claude Code使用。该项目公开了Bun从Zig语言向Rust迁移过程中使用的全套AI提示词与辅助工具。Bun是知名JavaScript运行时...

核心观点AI编程正从写代码升级为驾驭百万行级工程迁移,遗留系统改造或成大模型落地的下一个高价值战场。

阅读全文

开源工具scrollback:让Claude Code等AI编程Agent共享上下文

scrollback 是在 Linux.do 社区发布的开源项目,定位为跨 Coding Agent 的上下文共享与通信工具,由 CLI 和 MCP 两部分组成。该项目旨在解决 AI 编程工具的碎片化问题:目前 Claude Code、Codex、Gemini、Kimi、Cursor 等各类编程 Agent 的会话记录均保存在本地,但...

核心观点AI 编程工具越繁荣,上下文孤岛问题越尖锐,跨 Agent 的上下文协议层正成为开发者工作流的新基础设施。

阅读全文

JetBrains发布Air产品体系:全面押注AI智能体软件开发

JetBrains正式发布Air,一个面向智能体软件开发的系统化产品体系。作为IntelliJ IDEA、PyCharm等知名开发工具的缔造者,JetBrains此举标志着其从传统IDE厂商向AI原生开发平台的战略转型。JetBrains Air并非单一产品,而是一整套围绕智能体协作构建的产品矩阵,旨在让AI智能体深度融入软件开发生命...

核心观点IDE巨头的护城河正从编辑器体验转向代码理解深度,智能体软件开发已进入平台化体系竞争阶段。

阅读全文

阶跃星辰开源 AI 编程工具 Step Code:社区实测流畅度超 Claude Code

国产大模型公司阶跃星辰(StepFun)在 GitHub 上开源其 AI 编程工具 Step Code,仓库地址为 stepfun-ai/Step-Code。与 Grok Build、ZCode 的发行方式类似,该项目虽开放了源代码,但未提供任何官方 release 版本,用户需通过官网内部脚本完成安装。由于这种“有码无包”的开源方式...

核心观点“有码无包”的开源模式把信任成本转嫁给社区,AI 编程竞争已从模型能力延伸至发行策略与生态信任建设。

阅读全文

高德地图开放MCP接口:AI智能体可规划路线、查评价、动态改道

高德地图推出MCP Server服务,用户可将其接入Claude Code、Hermes等任意AI智能体,通过自然语言完成出行规划。据论坛用户实测分享,该服务整合了高德的路线规划能力,并纳入大众点评数据,智能体可查看餐厅评价等信息,帮助用户安排就餐。在实际使用中,该服务展现出较强的灵活性:当用户行程中遇到高速公路封路时,智能体能根据实...

核心观点地图巨头以MCP开放服务入口,预示智能体时代的竞争正从模型能力下沉到真实世界服务的调用权。

阅读全文

开源音乐模型YuE2发布加速方案YuE2-Turbo:消费级显卡10秒生成一首歌

开源音乐生成模型YuE2近日登上GitHub Trending榜首,Star数突破一万,其SongBench均分已进入Suno v5/v6、Mureka 9等商业模型所在区间。针对原版流水线一次只能处理一首歌、模型在任务间反复加载卸载的瓶颈,NoizAI团队开源了首个推理加速方案YuE2-Turbo。该方案未更换模型、未改动采样规格,...

核心观点AI音乐生成的竞争正从模型能力转向推理工程,开源阵营用消费级硬件跑通落地,是打破Suno闭源垄断的关键一步。

阅读全文

15年PDF引擎开发者发布AetherPDF 1.2.0:多Agent分工批量处理文档

独立开发者发布PDF编辑器AetherPDF 1.2.0版本,核心更新聚焦批量处理,推出多文档AI助手。新版本包含四项主要功能:一是多文档会话,用户可将整个文件夹拖入AI对话,对多个文件执行任务;二是多Agent分工机制,主Agent负责理解目标、拆分任务并派发工作,每个子Agent绑定一份文档且工具面相互隔离,单个子Agent无法访...

核心观点多Agent分工与工具隔离让AI文档处理从单点问答走向批量流水线,垂直工具正成为Agent技术落地的现实切口。

阅读全文

Apple 烂尾系统 Copland 复活:最后的 D11E4 版本可在浏览器中启动

Apple 在 1990 年代开发的 Copland 操作系统最后一个构建版本 D11E4,现已通过改进版 PowerPC 模拟器 DingusPPC 在浏览器中成功启动。Copland 长期以难以在真实硬件上运行著称,此前从未有过可用的模拟版本。项目由 pagetable.com 发布,作者指出,在真实硬件上启动 Copland 约...

核心观点被 Apple 废弃的系统靠开源模拟器在浏览器中复活,数字考古正成为对抗技术失忆的力量,而拒绝 AI 代码更凸显人工逆向的不可替代性。

阅读全文

Gravity Linux 早期 Alpha 发布:M4 Mac mini 跑通原生 Linux,GPU 与 DCP 驱动可用

Gravity Linux 团队(开发者 Cody Ho 与 Niklas Sheth)发布面向 M4 Mac mini 的早期 Alpha 版本,首次在该设备上实现可用的 DCP 显示协处理器与 GPU 驱动,GPU 已通过 OpenGL ES 3.0 与 OpenGL 3.3 合规认证。该项目是基于 Fedora 的发行版重制,默...

核心观点净室逆向攻克 DCP 与 GPU 驱动后,苹果封闭硬件生态正被开源社区一步步撬开,通用 Linux 生态向 M 系列芯片扩张已成趋势。

阅读全文

Grok 4.7 正式上线:编程跑分超同档 Opus 5,成本仅其一半

xAI 新旗舰模型 Grok 4.7 已正式上线 Modelflare 平台,支持 50 万 tokens 上下文窗口,接受文本和图片输入、输出文本,可通过 Chat Completions 与 Responses API 调用,此前的 grok-4.5 和 grok-4.6 仍可继续使用。在编程基准测试 CursorBench 的 ...

核心观点头部模型性能差距已收窄至统计误差级别,编程模型竞争正从跑分之争转向定价权之争。

阅读全文