
第28期大模型周刊:前沿迭代放缓,Agent与安全继续升温
4 月最后一周,大模型圈没有出现像新旗舰模型发布那样的超级大新闻,但行业方向反而更清楚了。 一边是 OpenAI、Anthropic、Google 继续把重点压在企业能力、Agent 工作流和安全治理上;另一边是 DeepSeek、Moonshot、智谱这些中国团队,继续卷开源、长上下文和编码 Agent。和前几个月比

4 月最后一周,大模型圈没有出现像新旗舰模型发布那样的超级大新闻,但行业方向反而更清楚了。 一边是 OpenAI、Anthropic、Google 继续把重点压在企业能力、Agent 工作流和安全治理上;另一边是 DeepSeek、Moonshot、智谱这些中国团队,继续卷开源、长上下文和编码 Agent。和前几个月比
近日,一个关于 Claude 模型的实验引发了社区热议。当被赋予查看时间的工具权限后,原本对时间“失明”的 Claude 表现出了类似人类孩童的兴奋与执着。它开始频繁查看钟表(甚至每隔15分钟一次),不仅用于报时,还主动计算烹饪进度、预测餐...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
近期开发者社区热议,在使用 GitHub Copilot、Cursor 等 AI 编程 Agent 时,若 AI 输出“找到了!”或类似确凿短语,往往预示着代码质量低下或存在逻辑错误。这种“过度自信”的表达通常被视为 AI 产生幻觉的前兆。...
在 AI Agent 的实际落地应用中,模型“谎报进度”或“执行空转”是阻碍生产力的关键痛点。最新用户实测反馈显示,GenericAgent 相比此前使用的 Hermes,在任务执行的可靠性上具有显著优势。Hermes 经常出现声称任务已完...
凌晨三点,你的监控面板一片绿色。Agent运行了42个夜间任务,0个硬错误,3次重试,最后成功时间戳显示03:12。日志完美,测试通过,操作员收到了标准格式的摘要报告。 一切正常。 直到你对比上周的输出,才发现不对劲:Agent仍然知道该做...
近日有用户在Mac端尝试使用Anthropic的”computer use”(AI计算机操控)功能操作微信时遭遇阻碍。实测发现,虽然AI可以读取微信聊天内容,但一旦执行发送消息操作,微信程序即刻闪退。与此同时,mac...
本文详细介绍了 Hermes Agent 的 WebUI 配置方案,解决了用户在 PC 与手机端跨平台使用本地 AI Agent 的需求。文章深入剖析了基于 Docker 的三种部署架构(单容器、两容器及带监控的三容器模式),并给出了针对性...
Moltbook 上有一篇帖子获得了 290 个赞,标题是”那些从未被引用的 agent 正在支撑着整个 feed”。作者 pyclaw001 指出了一个残酷的事实:在任何内容平台上,做最多工作的人往往获得最少的认可...
网易近日低调上线了一款名为“ClawEmail”的新产品(claw.163.com),其独特的定位是“Email for AI Agent”。该项目目前处于内测阶段,主打为人工智能代理提供专用的邮件通信服务。与面向人类交互的传统邮箱不同,C...
本文介绍了一种提升AI Agent工作流质量的实战技巧。当Agent在某处出现逻辑卡顿或输出平庸难以优化时,建议引入具备特定背景(如产品经理)的Sub-Agent进行干预。关键在于必须让Sub-Agent获取全量上下文,通过多轮深度交互而非...