智谱AI发布GLM-5 Turbo:专为Agent场景优化,支持128K超长输出
智谱AI(Z.AI)正式发布GLM-5 Turbo模型,作为GLM-5的高速变体,该模型专为OpenClaw(Agent/编码工具)场景深度优化。新模型增强了工具调用、复杂任务分解及时间感知能力,具备200K上下文长度和128K最大输出tokens(仅文本)。定价方面,输入费用低至每百万tokens 1.2美元,旨在为AI Agent...
阅读全文实时动态 / 第 715 页
追踪 AI、开源与工程领域的重要动态。
智谱AI(Z.AI)正式发布GLM-5 Turbo模型,作为GLM-5的高速变体,该模型专为OpenClaw(Agent/编码工具)场景深度优化。新模型增强了工具调用、复杂任务分解及时间感知能力,具备200K上下文长度和128K最大输出tokens(仅文本)。定价方面,输入费用低至每百万tokens 1.2美元,旨在为AI Agent...
阅读全文Autoresearch Hub 展示了一个极具前瞻性的“AI Agent 自主科研”实验现场。该平台巧妙地结合了 Anthropic 的 Claude Code(智能编程体)与 Nvidia H100 顶级算力,允许用户通过简单的指令接入,让 Agent 自动执行代码编写、实验运行及超参数调优。实时数据显示,该系统已完成了近 200...
阅读全文该资源库汇集了当前最前沿的开源大语言模型架构图与详细参数表,由 AI 专家 Sebastian Raschka 整理发布。内容不仅涵盖了 Meta Llama 3、DeepSeek V3/R1、Mistral 等国际主流模型,还重点收录了包括月之暗面 Kimi K2、Qwen、GLM 等国内头部模型。通过可视化的架构面板,开发者可以直...
阅读全文谷歌 Chrome 开发者团队宣布对 Chrome DevTools MCP 服务器进行重大增强,允许 AI 编码智能体直接连接并调试活跃的浏览器会话。此前,智能体通常在隔离环境中运行,而现在它们能够复用开发者已登录的页面上下文,并直接读取开发者工具中的网络请求或 DOM 元素数据。该功能目前处于 Beta 阶段(Chrome M14...
阅读全文社区近期热议一款名为Vibero的AI驱动论文阅读工具。该软件深度集成了Zotero文献管理生态,其核心亮点在于采用了“非线性阅读”设计,能够帮助用户在不脱离原文语境的前提下,快速提取段落核心观点,显著提升科研阅读效率。尽管产品设计获赞,但部分用户对其官方定价表示不满,并呼吁社区开发开源替代方案,以降低科研人员的使用成本。
阅读全文纯欧洲所有的办公平台 Office.eu 正式在海牙发布,旨在成为微软 Office 和 Google Workspace 的主权替代方案。该平台基于开源技术(部分基于 Nextcloud)构建,完全运行在欧洲数据中心,严格遵循欧盟数据保护法规。Office.eu 强调数据主权、隐私和透明度,提供文档编辑、协作及安全存储功能,并承诺提...
阅读全文文章介绍了 Wayland 合成器 River 0.4.0 的发布,其核心突破在于打破了传统单体架构,将合成器(负责渲染)与窗口管理器(负责策略逻辑)分离。通过新的 `river-window-management-v1` 协议,River 允许窗口管理器作为独立进程运行,这不仅大幅降低了开发门槛,使得开发者无需重写整个合成器即可开发...
阅读全文据社区用户反馈,Anthropic近期针对Claude的非企业级用户推出了一项优化措施,在离峰时间段提供加倍的使用额度。这一策略旨在通过激励手段引导用户错峰使用,以平衡服务器负载与GPU算力资源。对于开发者和个人重度用户而言,灵活利用离峰时段进行模型推理或长文本处理,将能显著降低使用成本,大幅提升AI工具的性价比与使用效率。
阅读全文Banana AI 是一款基于浏览器的一站式 AI 创作平台,无需下载客户端。其核心亮点在于集成了“文生图”、“文生视频”及图像编辑功能,支持 4K 高清导出与图生视频。该工具主打免费体验与多风格模板,能有效满足运营、自媒体及设计人员对快速产出图文与短视频素材的需求,解决了在多个应用间反复切换的痛点。
阅读全文针对仿人机器人难以在高速运动(如网球)中复刻人类动态技能的问题,研究人员推出了LATENT系统。该系统不再依赖难以获取的完美比赛数据,而是仅利用由基础动作片段组成的“不完美”人类运动数据作为先验知识。通过模拟环境中的校正与组合训练,机器人成功掌握了高动态击球策略。该技术已部署于宇树科技(Unitree)G1机器人,在现实世界中实现了稳...
阅读全文随着AI Agent开始自主浏览网页、读写代码并记忆上下文,Prompt Injection(提示词注入)已从理论漏洞变为现实威胁。文章通过GitHub漏洞和OpenAI Operator的测试数据(攻击成功率仍达23%)揭示了严重性:攻击者利用恶意网页或受污染的Issue注入指令,诱导Agent泄露私有数据或执行未授权操作。专家指出...
阅读全文本文犀利地抨击了当前AI编程领域的核心误区——将LLM的代码生成量等同于开发生产力。作者指出,编程的本质是管理复杂度和表达思想,而非单纯的代码输出。虽然LLM能极速生成大量代码,但这往往诱导开发者过早进入实施阶段,忽视了低成本的早期设计,并导致软件维护成本和认知负荷激增。文章强调,盲目追求代码行数是在制造“技术负债”,真正的生产力提升...
阅读全文针对现代编译器动辄数百万行代码的臃肿现状,一位开发者推出了名为GDSL的极简主义项目。该项目展示了一个仅800行的内核,并在此基础之上仅用约500行代码实现了Lisp子集,用约1500行代码实现了C子集编译器。作者质疑了行业对于“大规模代码是必要的”这一固有认知,指出许多现代系统的复杂性源于接缝、拼凑和补丁。这一成果表明,通过重构语言...
阅读全文许多开发者反映 Cursor Pro 的官方额度难以满足高强度编码需求。近期在技术社区 Linux.do 上,有用户尝试将在闲鱼购买的“无限版”智谱 GLM-5 模型接入 Cursor 编辑器,试图通过替换底层大模型来突破使用限制。这一尝试引发了社区关于国产大模型替代潜力及 AI 编程成本优化的热烈讨论,展示了技术圈对于更灵活、更低成...
阅读全文针对主流AI工具缺乏有效上下文管理的问题,一位开发者通过修改开源项目Codex Monitor,为AI编程工具Codex新增了“对话分支跳转”功能。该功能允许用户在对话中随时跳转至不同历史节点,避免了无意义追问污染核心上下文,解决了传统Fork操作导致的工作流割裂痛点。鉴于商业版Codex不开源且拒绝外部PR,作者选择基于开源版本进行...
阅读全文近日,有开发者在技术社区反馈,在使用名为“everything-claude-code”的工具时遭遇了极端的资源消耗问题。据该开发者描述,即使是随意的简单任务,Token消耗量也高达5M至10M(百万级),并伴随上下文冲突和需求误解等问题。这一案例不仅揭示了第三方AI工具可能存在的集成缺陷,也再次提醒业界在享受AI编程便利的同时,必须...
阅读全文AI中转平台MonkingAI针对旗下“Kiro”逆向渠道的模型标注问题发布公开致歉。经用户实测发现,该平台原本标注为顶级模型Claude 3 Opus的接口,在实际调用中被重定向至性能较低且成本更便宜的Sonnet模型。MonkingAI承认这是上游选型及验收环节的失职,并已第一时间下线问题分组。为承担责任,平台决定将该渠道已产生的...
阅读全文面对AI领域爆发式增长的资讯,AI RSS Hub 提供了一套基于大语言模型的智能解决方案。该工具允许用户聚合各类RSS源,并通过自定义AI提示词或正则表达式,对海量内容进行过滤、去重和关键词匹配,实现精准的“特别关注”更新提醒。其亮点在于支持接入免费或低成本的大模型API,以极低的成本完成高质量的信息筛选。对于需要追踪前沿技术、自动...
阅读全文本文记录了一次关于数字针织机的研讨会,作者通过对比Kniterate软件与开源的knitout工具,深入探讨了“材料编程”与参数化设计在纺织制造中的应用。文章详细解析了针织文件的结构、起底工艺以及罗纹编织等操作流程,并指出了不同软件在可视化交互上的差异。作者的核心洞察在于,将Kniterate的可视化界面比作Tinkercad(适合初...
阅读全文本文深入探讨了英特尔Optane(傲腾)系列SSD为何能在高性能存储领域独树一帜。基于Intel与Micron联合研发的3D XPoint技术,Optane虽然在容量和成本上不敌传统NAND闪存,但在关键技术指标上具有压倒性优势。其核心卖点主要体现在三个方面:一是超低延迟,随机读取延迟仅为25微秒,远低于NAND SSD;二是极高的耐...
阅读全文