惊叹大模型的“读心术”:Qwen 3.5 深度分析用户发帖,精准识破防御机制与认知偏差
一位用户在测试通义千问 Qwen 3.5 Plus 时,意外见证了 LLM 惊人的语言风格分析能力。在提供数十条论坛发帖记录后,Qwen 不仅发现了用户精心使用 emoji 的细节,更深刻指出了其文字背后“缺乏自信”和“叠甲”等心理防御机制...
标签索引 / 第 125 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
一位用户在测试通义千问 Qwen 3.5 Plus 时,意外见证了 LLM 惊人的语言风格分析能力。在提供数十条论坛发帖记录后,Qwen 不仅发现了用户精心使用 emoji 的细节,更深刻指出了其文字背后“缺乏自信”和“叠甲”等心理防御机制...
近日,V2EX 社区分享了 GitHub 知名开源项目《Context-Engineering》(上下文工程)的中文翻译版本。随着大语言模型(LLM)的普及,技术焦点正从简单的提示词编写转向更复杂的上下文管理。该项目深入剖析了如何通过构建高...
ZSE是一款全新的开源大语言模型推理引擎,主打极致的内存效率与高性能。其核心创新包括自研的zAttention注意力机制、INT2-8混合精度量化以及zStream层级流式传输技术,允许在仅24GB显存的消费级显卡上运行700亿参数模型。实...
一位开发者通过调用 Claude API 进行了 3.75 万次实验,试图让 AI “随机”挑选一个名字。结果令人震惊:Claude 模型表现出了极强的一致性偏差,名字“Marcus”在男性名字中出现了 23.6%,在 Opus 4.5 模...
近期有数据分析指出,知名科技社区Hacker News疑似正遭受大量AI机器人账号的“入侵”。通过抓取新评论与新手评论的数据发现,新注册账户使用破折号、箭头等特殊符号的频率比老账户高出近10倍,且提及AI和LLM的频率也显著更高。这种统计学...
最新研究揭示了人工智能在隐私领域的重大风险:大语言模型(LLM)代理能够通过分析用户的匿名在线发帖,成功推断并锁定其真实身份。虽然已知少量特征即可唯一标识个人,但过去受限于非结构化数据处理和人工推理的高成本,去匿名化难以规模化。该研究证实,...
一位开发者在技术论坛实测对比发现,字节跳动的豆包模型(疑似Seed 2.0)在执行特定编程任务时表现不佳,不仅在生成逻辑和代码上出现严重的“幻觉”和胡编乱造现象,还频繁报错,导致项目无法推进。该测试对比了Claude,结果显示国产模型在稳定...
有用户在Linux.do社区反馈,字节跳动旗下AI助手“豆包”疑似对知名科技评测博主“极客湾”实施了针对性的关键词屏蔽。测试表明,当用户询问关于“极客湾”视频下架等敏感问题时,豆包不会调用联网搜索,而是直接生成回复;然而,若将主体替换为“影...
针对现有浏览器划词插件功能臃肿或模型受限的痛点,开发者推出了“FlashClip 闪电划词”。该扩展基于 React 19 和 Tailwind CSS 4 构建,支持接入 OpenAI、Claude、DeepSeek、豆包等 17 种国内...
伦敦国王学院的一项最新研究揭示了一个令人不安的趋势:在模拟的地缘政治危机中,来自OpenAI、Anthropic和Google的顶尖大语言模型表现远比人类激进。研究显示,这些AI在95%的战争推演中选择了动用核武器,且完全缺乏人类决策者通常...