实测发现Gemini疑似悄然更新:视觉幻觉修复,不再“胡乱认人”
近日,有科技爱好者通过对比测试发现,Gemini可能正在灰度推送其新版本模型(暂称3.1)。测试针对一张旧版模型极易出错的“视觉陷阱”图片,在旧版中,模型常因视觉幻觉将光头人物误认为微软CEO纳德拉,导致无法完全答对。然而,在连续5次的新模...
近日,有科技爱好者通过对比测试发现,Gemini可能正在灰度推送其新版本模型(暂称3.1)。测试针对一张旧版模型极易出错的“视觉陷阱”图片,在旧版中,模型常因视觉幻觉将光头人物误认为微软CEO纳德拉,导致无法完全答对。然而,在连续5次的新模...
据技术社区反馈,通过 Antigravity 反代访问 Google Gemini 模型的近期体验急剧恶化。用户实测发现,Gemini 1.5 Pro 模型首字生成延迟(TTFT)常超过一分钟,复杂查询甚至触发 Cloudflare 的 1...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
据社区用户反馈,Google近期已向Gemini网页版及移动端APP的全面开放了AI音乐生成功能。此前该功能可能仅限于特定订阅用户,但目前无论是Pro付费用户还是免费账号用户,均已确认可以使用。这一更新表明Google正加速将DeepMin...
近日,有科技爱好者在 V2EX 分享了对主流大模型的使用体验,引发了关于 AI 模型“人设”的讨论。该用户指出,ChatGPT 在处理价值判断和社会科学问题时,过于追求中立和道德正确,甚至输出说教式的“废话”,令人反感;Grok 则显得刻意...
本次评测基于真实医学场景,对比了DeepSeek、Qwen及Gemini系列模型在1M长上下文下的表现。测试让各模型基于50篇文献摘要撰写综述,结果显示DeepSeek凭借新技术在生成质量和连贯性上表现最佳,有效提升了注意力机制;Qwen-...
一位社区用户在对比测试中发现,针对同一份PDF文档的知识问答,Google推出的NotebookLM在回答准确度上显著优于通用大模型Gemini。Gemini被指出现回答混乱、甚至“瞎编”的现象,暴露了其直接处理文档资料时RAG(检索增强生...
一位科技爱好者分享了 Google Gemini 在音乐生成领域的最新实测体验。通过输入包含流派、音色、情绪及主题的详细提示词,要求生成一段以海洋为主题、具有清澈合成器音色和强力底鼓的 Progressive House 高潮 Demo。测...
随着AIGC技术的普及,用户对画质的要求日益提升,但近期反馈显示,ChatGPT、Copilot及Gemini等主流AI工具在输出高分辨率图片方面存在明显短板。实测发现,这些平台生成的图片往往被限制在1536×1024或更低分辨率...
据科技社区反馈,Google Gemini 的命令行工具(CLI)目前正面临严重的访问故障。多位开发者表示,从大约一小时前开始,连接服务时持续收到 HTTP 429 错误,系统提示“we are experiencing high dema...
这篇文章分享了作者从零构建低延迟语音助手的实测经验。不同于以往依赖 LiveKit 等现成框架,本次尝试完全基于纯 API 调用搭建,旨在探索性能极限。测试结果显示,得益于 Google Gemini 2.5 Flash Lite 的出色推...