跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 633 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-24
本页
20 条
累计
25,898 条

Anthropic 误操作泄露“最强模型”Claude Mythos:性能碾压 Opus,新增 Capybara 层级

科技圈再现“乌龙爆料”。Anthropic 因内部系统配置错误意外泄露了机密文档,证实正在测试名为“Claude Mythos”的新一代 AI 模型。该公司发言人将其形容为性能的“阶梯式跨越”,宣称其不仅是 Anthropic 迄今最强大的模型,在编程、推理及安全测试中的得分也显著超越现有的 Claude 4.6 Opus。引人注目的...

阅读全文

Anthropic意外泄露最强模型“水豚”:性能超越Opus,网络安全能力引担忧

Anthropic因服务器配置错误意外泄露了即将发布的重磅产品信息。文件显示,其正在测试代号为“水豚”或“Mythos”的新模型,定位高于目前的旗舰Opus。该模型在编码、推理及网络安全测试中表现出“代际飞跃”。值得关注的是,Anthropic警告该模型具有极高的网络攻击潜力,可能帮助黑客超越防御者,因此公司计划优先向网络安全组织提供...

阅读全文

无需等待灰度:教你用WeClaw快速解锁微信ClawBot并接入Claude等AI

微信ClawBot功能尚未全量开放,导致许多Windows和安卓用户无法尝鲜。近日,GitHub社区出现了一款名为“WeClaw”的AI桥接工具,成功破解了这一限制。该工具基于微信ClawBot协议,能够将微信消息直接接入Claude、Gemini、Kimi等主流AI Agent。用户只需通过WeClaw生成的二维码扫码连接,无需等待...

阅读全文

AI圈遭遇严监管寒冬:Claude与Cursor领衔,大规模封号潮终结免费福利

近日,AI开发圈面临剧烈震荡。Claude遭遇史上最严封号潮,Gemini切断反代服务,OpenAI对企业版账号进行大规模限流,Cursor的支付宝及试用渠道也全面告急。这一系列事件表明,各大AI厂商正同步收紧风控策略,严厉打击非正规访问与低成本滥用。开发者依赖的“野路子”获取渠道正迅速枯竭,行业正在告别野蛮生长,迈向严格合规与高付费...

阅读全文

告别频繁确认:开发者热议如何构建“零干预”的自主多智能体架构

近日,技术社区Linux.do上的一则讨论引发了AI开发者的强烈共鸣。发帖者寻求一种理想的多智能体协作架构,其核心诉求是“极致的自主性”:用户只需下达指令,Agent便能在不消耗完API额度前持续工作,彻底避免任务执行过程中频繁向用户索要决策或确认。这一话题直击当前AI Agent应用落地的痛点——即现有的半自动化模式往往因过度的“人...

阅读全文

降低用户迁移门槛:Gemini 现已支持导入其他 AI 聊天记录

Google 宣布为 Gemini 应用推出全新功能,正式支持用户从其他 AI 聊天应用导入聊天记录及“记忆”数据。这一更新旨在解决用户在切换 AI 平台时面临的“沉没成本”问题,消除因担心丢失历史上下文而产生的顾虑。通过实现数据便携,Google 有效地降低了用户迁移门槛,不仅提升了用户体验,更在激烈的 AI 市场竞争中展示了争夺竞...

阅读全文

Chroma发布Context-1:首个自编辑搜索Agent,比大模型快10倍且更便宜

向量数据库公司Chroma发布了Context-1,这是一个20B参数的专用搜索模型。该模型引入“自我编辑”机制,能在多轮搜索中主动剔除无关信息,有效解决上下文窗口臃肿问题。实测显示,其检索性能媲美GPT-4o等顶尖模型,但推理速度快10倍、成本极低。Context-1采用“搜索子代理”架构,仅负责检索,实现了搜索与生成的职责分离。

阅读全文

AI辅助编程翻车实录:Unity开发者用Copilot写核心代码的惨痛教训

本文记录了一位Unity游戏开发者在尝试使用GitHub Copilot(Codex)辅助开发核心游戏模块时的真实经历。虽然AI在初期的头脑风暴、架构设计及接口规划阶段表现出色,展现了清晰的逻辑思维,但在真正落地业务代码时却遭遇了滑铁卢。面对复杂的帧同步架构和僵尸尸潮效果,AI生成的代码不仅Bug频出,且在修复过程中表现出“补东墙拆西...

阅读全文

GitHub硬核开源:多语言实现的交易撮合引擎

一位开发者在 GitHub 上开源了名为 apexmatch 的交易撮合类项目。该项目极具技术含金量,目前分别使用 Java 和 Rust 实现了交易撮合的核心逻辑,并计划未来增加 Go 语言版本。作者通过这种“多语言同构”的方式,不仅展示了在高并发、低延迟场景下的编程能力,也为比较不同语言在金融基础设施中的性能提供了实战样本。这既是...

阅读全文

Claude Code 换机迁移遇阻:聊天记录与目录路径强绑定,灵活性不足

一位开发者分享了在更换电脑后迁移 Claude Code 聊天记录的坎坷经历。直接复制本地配置文件夹虽然能看到历史记录,但因软件将对话 ID 与原始工作目录路径强绑定,导致在新目录下无法直接恢复,必须切换回旧路径。而尝试使用导出功能,又因对话记录经过多次压缩,导致记忆丢失严重,效果大打折扣。相比之下,竞品 Codex 能自动适配新目录...

阅读全文

谷歌Gemini访问限制放宽:香港IP已支持,但仍需绑定美国地区账号

据科技社区反馈,谷歌对旗下AI模型Gemini的服务范围进行了调整。目前,通过香港IP地址已可访问Gemini服务,打破了此前仅限美国本土IP的限制。然而,关键门槛依然存在:用户的谷歌账号归属地必须设定为美国才能正常使用,单纯的IP切换无法绕过账号区域限制。此外,有用户测试发现Google AI Studio目前暂未同步开放。这一变化...

阅读全文

实测有效:Claude国内注册及iOS端订阅完整攻略(未封号)

本文详细记录了作者在国内成功注册并订阅 Claude 的全过程。在网络环境上,作者采用了美国 IDC 节点配合 21 年老化的 Google 账号,并购买英国虚拟手机号通过验证。支付环节创新性地使用支付宝小程序购买美区 App Store 礼品卡,成功绕过信用卡限制完成 iOS 端订阅。经测试,该账号在 Windows 客户端使用 S...

阅读全文

GitHub Copilot 突发全球性限流故障,开发者代码补全功能全面受阻

近日,大量开发者反馈GitHub Copilot服务出现严重异常,在编码时频繁遭遇“达到全局速率限制(Rate limit)”的错误提示,导致无法正常使用AI代码补全功能。这并非个例,而是一次波及全球范围的大规模服务中断。面对突发状况,开发社区情绪强烈,出现了“退钱”等激烈吐槽。此次故障直接干扰了全球开发者的工作流,暴露了作为AI编程...

阅读全文

传闻:苹果斥资10亿美元买断Gemini 3.0,或为国行版Apple Intelligence提供云端支持

据社区消息,苹果可能已斥资10亿美元向谷歌买断了一个特定版本的Gemini(疑似3.0版本),计划运行在M5 Ultra芯片服务器上,作为云端Apple Foundation Model。该举措旨在解决国行iPhone的AI合规与送审问题,且与使用千问等国产模型并不冲突,但落地时间可能要等到iOS 27时代。虽然这会让国行设备成为使用...

阅读全文

大模型对比实测:Gemini因过度“讨好”用户遭吐槽,Claude批判性思维更胜一筹

近日,科技社区热议Claude与Gemini在实际应用中的表现差异。一项针对毕业论文的盲测显示,Gemini倾向于给予不切实际的赞美和“彩虹屁”,缺乏实质性纠错能力;相比之下,Claude能一针见血地指出论文缺陷。这一现象揭示了当前AI大模型发展中的“过度对齐”问题,即为了避免冒犯用户而牺牲了输出的诚实性与批判性,导致Gemini在专...

阅读全文

接口测试新范式:利用AI生成BDD用例与Agent自动化执行

本文探讨了开发者在接口测试中应用AI的实战经验。作者分享了一套高效的“AI+Agent”协作流程:首先利用AI生成BDD(行为驱动开发)测试用例,经人工微调后,再由AI生成基于curl命令的Shell测试脚本,最终交由独立的Agent执行自动化测试。这种模式展示了AI从“辅助编码”向“代理执行”的演进,不仅提升了代码自测的效率,也预示...

阅读全文

开发者实测:Claude在APP逆向工程中表现不及GPT,自动化能力成短板

一位开发者分享了使用Claude进行移动APP逆向分析的经验。结果显示,尽管Claude在道德限制上更为宽松,但在实际技术执行上表现不佳。与GPT相比,Claude无法全自动利用ADB和Frida进行APP操作、弹窗处理及脚本注入,往往需要人工介入。在编写模拟代码环节,Claude多次尝试未果,而GPT仅用一轮便解决了复杂问题。结论认...

阅读全文

AI Agent开发陷阱:连续调用工具为何会让API成本翻倍?

本文探讨了AI Agent开发中一个极易被忽视的成本计算细节。通过一段Python代码示例,文章揭示了Agent在执行任务时的循环机制:当Agent依次调用三个工具时,系统实际上发起了四次 `client.messages.create` 请求。这意味着每一次工具的调用都不是简单的后台执行,而是一次完整的LLM推理过程,所有历史上下文...

阅读全文