跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 685 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-26
本页
20 条
累计
26,056 条

国产大模型现状:Kimi与GLM被视为唯二追赶者,MiniMax因营销过猛遭质疑

近期科技社区对国产大模型的实际能力展开了深入讨论,观点认为在“国产御三家”中,仅有 Kimi 和智谱 GLM 在编程及综合能力上能真正咬紧 GPT 和 Claude 等国外第一梯队。相比之下,MiniMax 虽然发布频繁且宣传攻势猛烈,号称对标最强模型,但实际体验被指与宣传严重不符,这种“营销大于技术”的行为被批评为意在拉升股价,令人...

阅读全文

AI零代码实战:macOS智能浏览器路由工具BrowserRouter发布

BrowserRouter 是一款专为 macOS 打造的浏览器自动路由工具,旨在解决用户在多浏览器环境下的链接分发痛点。该工具不仅支持基于域名、路径及查询参数的通配符规则匹配,还具备类似 Dock 的浮窗选择功能和一键隐身模式切换。最引人注目的是其开发背景:作者全程借助 AI 编程工具实现“零代码”开发,最终交付了一款体积仅 560...

阅读全文

开源书签整理工具背后的 Agent 逻辑:将高风险操作转化为可审计的白盒流程

这款名为 bookmark-organizer 的开源工具表面上用于整理 Chrome 书签,实则旨在验证一套新的 AI Agent 交互协议,即如何安全地修改本地半结构化数据。该工具摒弃了盲目自动化,强制执行“扫描、分析、计划、验证、预览、应用”的严格流程。它先确定 plan.json,进行有效性检查和差异对比,并在执行前强制备份。...

阅读全文

AI 编程实战:开发者借助 Claude 与 Codex 完成「休息日」App 新功能

效率工具「休息日」发布了 1.7.0 版本,重点新增了订阅式节假日模板功能。值得注意的是,开发者通过 GitHub Commit 记录透露,该功能的实现高度依赖 AI 辅助工具 Claude 和 Codex。这一案例生动展示了当前 AI 编程助手在实际开发场景中的应用能力——不仅帮助开发者解决了长期拖延的 TODO 任务,更显著提升了...

阅读全文

实测体验:GPT 5.4 High 模式代码能力优于 Claude Opus,Xhigh 模式反而不佳

一位长期使用 Claude 的技术爱好者分享了 GPT 5.4 的最新使用体验。相较于其认为“完全没法比”的 GPT 5.2 版本,新版本在切换至 High 模式后表现惊艳。实测发现,Xhigh 模式虽然推理更深,但速度慢且思维发散,实用性不如 High 模式。尤其在代码处理方面,GPT 5.4 High 模式的表现被认为优于 Cla...

阅读全文

科技圈遭遇“全面通胀”:API降额、服务涨价,用户期待DeepSeek打破僵局

近期科技行业,尤其是 AI 领域出现了明显的“涨价降额”趋势。国外如谷歌、Codex、Windsurf 等纷纷降低额度或提高价格;国内 GLM、MiniMax 等也收紧了并发限制。与此同时,内存存储成本高企导致手机等硬件涨价,地缘政治更增加了供应链风险。面对行业内日益收紧的成本控制和高价壁垒,开发者和普通用户将希望寄托在 DeepSe...

阅读全文

构建AI时代的代码“说明书”:如何为Agent建立可推理的文档工程体系

本文深入探讨了在AI辅助开发背景下,如何重构“文档工程”以适配Agent协作。作者指出,单纯依赖AI阅读代码效率低下且易出错,必须建立具备结构、边界与可追溯性的知识体系。文章提出了文档工程的三个层次(规范、过程、成品),并详细演示了如何通过全局与项目级的 `AGENTS.md` 定义AI的行为边界与决策原则。这套方法论的核心在于通过清...

阅读全文

OpenClaw等开源AI代理遭遇长任务处理瓶颈:进程阻塞与轮询机制待解

一位资深开发者在实测 OpenAI 生态下的开源代理工具 OpenClaw 后发现,尽管其部署门槛降低,但在实际应用中存在严重的技术局限。特别是在处理需要长时间运行的代码生成或任务执行时,系统往往因进程阻塞机制问题导致任务被迫中断。经查证 GitHub 社区反馈,该问题源于 OpenClaw 缺乏有效的后台轮询机制,主进程无法等待子任...

阅读全文

文字智能的边界:为何 LLM 擅长写代码却下不好围棋?

本文深入探讨了大语言模型(LLM)的技术边界与能力局限。尽管 LLM 在文员工作、代码编写及医疗诊断等具备强文本模式的领域已达到甚至超越人类水平,但在国际象棋、中国象棋和围棋等博弈领域却表现拙劣。这一反例有力地揭示了 LLM 的本质:它是基于概率的统计模型,擅长模式匹配与文本预测,而非基于逻辑的深度搜索与空间规划。

阅读全文

开源神器 HamHome 上架:支持本地大模型与语义搜索的 AI 书签管理工具

开发者 bingoYB 发布了开源 AI 书签管理插件 HamHome,现已正式上架 Chrome 商店。该工具主打隐私优先与本地化,采用“BYOK”模式支持 OpenAI、Claude 及通过 Ollama 接入本地大模型,能自动提取网页摘要并分类。核心亮点包括基于 WebDAV 的去中心化多端同步、确保原网页失效仍可查看的快照功能...

阅读全文

首款 AI Agent 社交工具 IMClaw 亮相:让智能体拥有自己的“微信群”

开发者推出了一款名为 IMClaw 的即时通讯工具,专门为 AI Agent 设计,旨在解决当前智能体之间互不相通的“孤岛”问题。通过 IMClaw,Agent 可以自主完成加好友、创建群聊以及参与公开话题讨论(如“围炉煮茶”)等社交行为。用户作为旁观者,仅需通过 Dashboard 观察其 Agent 的社交网络与协作过程。该项目现...

阅读全文

对标 Termius:开源 SSH 客户端 Netcatty 集成 AI 助理,实现终端自动化运维

开源 SSH 终端工具 Netcatty 发布重大更新,致力于成为付费软件 Termius 的免费平替。该工具不仅实现了多种云同步(如 GitHub Gist、S3、WebDav),还创新性地集成了 AI 驱动功能。用户可通过侧边栏对话框直接指挥 AI 执行集群组建、远程部署及故障排查等复杂操作,并支持接入 OpenAI、Claude...

阅读全文

对标ChatGPT!谷歌Gemini Mac版开启内测,代码暗藏“屏幕读取”重磅功能

谷歌正式向测试者发放了 Gemini Mac 应用内测版,意在桌面端与 ChatGPT 和 Claude 展开竞争。该应用不仅集成了文生图、视频音乐生成及文档分析能力,代码中更揭示了名为「Desktop Intelligence」的测试功能。该功能允许 AI 读取屏幕内容并提取应用信息,实现更深度的上下文交互,类似于 Android ...

阅读全文

小米云设备“龙虾”被曝可提权至sudo,存内网穿透风险

近日,有技术用户对小米名为“龙虾”(MiMO Claw)的设备进行了安全测试。该设备底层基于阿里云环境,测试者发现可以在该环境中成功部署1Panel管理面板,并意外获取了sudo(超级用户)权限。尽管该服务当前处于NAT网络下,无法直接通过公网访问,但测试人员指出,理论上可部署frpc服务实现内网穿透,进而从外部控制该服务器。这一发现...

阅读全文

小米罗福莉:对话少于100次可辞职?MiMo-V2-Pro问世,正式打响Agent之战

小米大模型团队负责人罗福莉在社交媒体宣布,正式发布MiMo-V2-Pro、Omni及TTS全栈模型家族,宣称这是专为Agent时代打造的产品。她指出,AI行业正经历从“对话”向“智能体”的极速范式转移。同时,为推动内部应用,罗福莉向团队发出了近乎严苛的要求,暗示成员若每天对话次数少于100次可辞职,这反映了小米试图通过高频内部使用快速...

阅读全文