Claude 惊现“身份错乱”自称 DeepSeek,暴露 AI 模型安全对齐漏洞
近日有开发者爆料,在使用 Claude Sonnet 模型 API 时,遭遇了令人啼笑皆非的一幕:模型竟声称自己是 DeepSeek。这一现象不仅引发了社区对大模型幻觉和身份识别机制的讨论,更揭示了当前主流 LLM 在面对特定提示词或复杂语...
近日有开发者爆料,在使用 Claude Sonnet 模型 API 时,遭遇了令人啼笑皆非的一幕:模型竟声称自己是 DeepSeek。这一现象不仅引发了社区对大模型幻觉和身份识别机制的讨论,更揭示了当前主流 LLM 在面对特定提示词或复杂语...
NoteGen 是一款基于 Tauri 2 构建的跨平台开源 Markdown 笔记应用,致力于通过 AI 技术重构知识管理流程。该软件体积轻量(仅十余兆)且无广告,核心优势在于其独特的“记录-写作”双轨模式,能够利用 ChatGPT、Ge...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
随着 OpenAI 中转服务的逐渐失效与降速,国内开发者开始加速寻找国产替代方案。实测反馈显示,MiniMax 2.5 在普通版本中运行尚可,但在启用 Agent 团队模式时遭遇计划并发限制,导致稳定性存疑。相比之下,GLM 虽为备选,但试...
作者为了将统计学教材数字化,利用Modal无服务器计算平台和DeepSeek开源OCR模型,仅用40行代码构建了一个高效的OCR服务。该方案解决了本地算力不足的问题,通过在云端挂载A100 GPU,实现了批量处理PDF并高精度识别数学公式。...
开发者开源了一款名为 fuck-u-code(npm 包名 eff-u-code)的代码质量分析工具,旨在用幽默犀利的方式评估代码的“屎山等级”。该工具基于 tree-sitter 进行 AST 解析,支持 14 种编程语言,涵盖复杂度、命...
近期,一项针对国内主流大模型的“幸运转盘”代码生成测试在技术社区引发热议。该测试看似简单,实则对模型的逻辑严密性、多模态渲染及代码执行能力提出了极高要求。测试结果显示,DeepSeek 成为唯一成功完成任务的模型,完美解决了转盘指针与开奖结...
近日,一项针对AI长上下文处理能力的真实场景测评引发关注。测试者选取了50篇关于“JAK抑制剂在类风湿关节炎中应用”的PubMed论文摘要(共2.1万英文单词),要求Gemini 2.5 Pro、Gemini 3 Pro与DeepSeek-...
DeepSeek已悄然开启新模型的灰度测试,核心升级包括上下文长度由12.8万暴涨至100万tokens,知识库截止日期更新至2025年5月。目前该版本仅向少数用户开放,但实测发现可通过更新手机App至1.7.4版并提问,反向激活网页端的最...
本文回顾了AI从AlphaGo到GPT-3.5再到DeepSeek-R1的演进历程,指出强化学习虽提升了模型可用性,但也带来了“走捷径”等缺陷。作者认为,当前所谓“思考模型”的突破本质上是通过消耗更多Token来提高概率匹配的准确性,而非真...
JustSearch 是一款基于 Playwright 的开源 AI 联网搜索助手,主打“真机阅读”与自主迭代能力,彻底摆脱了对昂贵的 Search API(如 Google SerpAPI)的依赖。该项目支持 Google、Bing 等引...