重蹈 DeepSeek 覆辙?Gemini 3.1 陷入中文“极其”无限循环
继 DeepSeek V3.1 因乱码“极”字翻车后,Google Gemini 3.1 Pro 也被曝出类似的中文生成 Bug。该问题表现为模型在描述程度时过度或重复使用“极其”一词,导致生成内容逻辑崩坏。测试表明,该 Bug 广泛存在于...
继 DeepSeek V3.1 因乱码“极”字翻车后,Google Gemini 3.1 Pro 也被曝出类似的中文生成 Bug。该问题表现为模型在描述程度时过度或重复使用“极其”一词,导致生成内容逻辑崩坏。测试表明,该 Bug 广泛存在于...
有开发者实测发现,Gemini 3.1 Pro 在处理约 20 万字符的长文翻译任务时表现不佳,出现严重的幻觉和 Token 重复现象。尽管宣称支持 1M 上下文,但其在仅完成约五分之一任务时便开始“胡言乱语”,推测有效上下文可能仅在 20...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
本文记录了一位非技术背景用户尝试利用 DeepSeek、Qwen 及字节跳动 Trae 等主流 AI 工具开发养鱼提醒 APP 的全过程。结果显示,面对具体的逻辑判断需求(如基于温度的喂食频率),现有模型生成的代码质量低劣、逻辑混乱,完全无...
近期网络流传的消息显示,国产大模型厂商将在二月份迎来一波前所未有的集中发布潮。根据爆料,Moonshot AI 计划于2月2日推出 Kimi K2.5;随后在2月12日,智谱 AI 与 MiniMax 将分别发布 GLM-5 和 M2.5 ...
DeepSeek虽无原生多模态生成能力,但用户通过“提示词工程”创新玩法,利用Pollinations.ai接口让其具备了绘图功能。用户只需预设特定Prompt,让DeepSeek将文本描述转化为英文并填入API链接,即可由后台Flux等模...
这是一款基于多智能体协作的AI谈判应用,旨在通过自动化博弈解决利益冲突。用户可自定义场景(如年终奖分配)并设定底线,随后由DeepSeek与Second Me驱动的两个AI分身进行三轮自动谈判。系统参考了NeurIPS 2024论文策略,最...
春节期间,一位网友在技术社区分享了使用 DeepSeek 生成“赛博烟花”代码的趣味案例。通过自然语言交互,DeepSeek 快速输出了一段完整的 HTML/Canvas 源码,实现了一个包含喷泉、魔术弹等五种可切换效果的高仿真 2D 烟花...
近日有用户在使用 DeepSeek 时发现,针对复杂话题(如拖延症的成因)的单轮提问往往会导致模型遗漏关键信息。为解决这一痛点,该用户提出并实测了一种“先大纲、后展开”的提示词工程策略。通过强制模型先生成结构化大纲,再针对分点逐一追问,成功...
本次评测基于真实医学场景,对比了DeepSeek、Qwen及Gemini系列模型在1M长上下文下的表现。测试让各模型基于50篇文献摘要撰写综述,结果显示DeepSeek凭借新技术在生成质量和连贯性上表现最佳,有效提升了注意力机制;Qwen-...
社区最新测试显示,xAI正在内测的Grok新版本(疑似Small/A8变体)在降低幻觉和联网搜索方面表现优异,但视觉和编程能力仍显不足。技术分析推测,该模型并非运行四个独立模型,而是采用单一权重的多Agent协作架构(Grok、Harper...