用户热议 Claude 出现“降智”现象,性能波动或源于第三方接入平台
近日,关于 Claude(特别是 Opus 版本)近期出现“降智”的讨论在社交媒体和技术社区升温。尽管部分用户感觉回答质量明显下降,但深入分析指出,这种性能波动很可能并非 Anthropic 官方模型的退化,而是源于第三方接入平台(如 An...
标签索引 / 第 66 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,关于 Claude(特别是 Opus 版本)近期出现“降智”的讨论在社交媒体和技术社区升温。尽管部分用户感觉回答质量明显下降,但深入分析指出,这种性能波动很可能并非 Anthropic 官方模型的退化,而是源于第三方接入平台(如 An...
国内 AI 独角兽 MiniMax 正式确认,其全新大模型 M2.7 将于本周末开源。作为 M2.5 的迭代版本,M2.7 预计将在性能和生态兼容性上进一步提升。在 DeepSeek 引爆全球 AI 圈、重写开源模型格局的背景下,MiniM...
Hacker News上热议的开源项目Hippo,提出了一种受生物神经系统启发的AI智能体记忆解决方案。针对当前大模型(如Claude)在跨会话记忆检索上的不足,Hippo引入了类似人类大脑的“记忆衰减”与“巩固”机制。社区讨论进一步探讨了...
近日,有科技社区用户反馈,在使用Kimi生成英语作文模板时发现了明显的语法错误。令人意外的是,当用户要求Kimi自行检查时,模型未能识别出错误;而在用户明确指出具体语法问题后,Kimi依然表现出逻辑混乱甚至“坚持己见”的态度。这一事件引发了...
近日,有科技社区用户吐槽 ChatGPT 的回答风格变得越来越“傲慢”和“说教”。该用户指出,在使用英文提示词时,ChatGPT 经常以“你的错误假设是”或“你混淆了概念”作为开头,强行纠正用户并未提及的误解。例如,在询问 MCP、AI A...
近期,“Harness Engineering”在 AI Agent 领域引发热议,被视为解决大模型不稳定性的关键工程实践。该概念由 Terraform 创作者 Mitchell Hashimoto 提出,并迅速得到 OpenAI 和 An...
近期研究发现,大模型正在对人类语言习惯产生显著的反向影响。例如,“delve into”一词的使用频率在GPT出现后出现异常飙升,根因竟是模型训练数据中标注员的地域习惯被习得,随后被人类用户无意识地模仿。这一现象揭示了“AI腔”的盛行:我们...
V2EX网友分享了名为“偃师”的开源DIY项目,利用ESP32-S3、OV5640摄像头及音频模块等低成本硬件,结合DeepSeek等云端大模型与Agent框架,成功组装出一款高性能AI智能眼镜。该项目展示了边缘硬件与云端智能结合的潜力,证...
最近在开发者社区进行的一项AI“狼人杀”测试引发了热议。测试发现,在多局游戏中,代表顶尖水平的模型(如Opus46和GPT54)总是第一轮就被“票死”。这种现象并非出于恩怨,而是源于AI独特的“Meta推演”逻辑:它们为了获胜,会优先判定并...
文章探讨了使用大语言模型(LLM)辅助编程如何自然地推动项目向微服务架构演进。由于微服务具有明确定义的输入输出接口(即“契约”),AI可以在不破坏外部依赖的前提下,在服务内部自由重构代码,这类似于在“防空洞”中引爆AI炸弹。相比之下,单体架...