科技社区最新实测显示,谷歌推出的音乐生成模型 Lyria 3.5 在多项指标上呈现出矛盾的进化态势。在纯音乐维度,3.5 版本展现出了显著的提升,其人声真实感更强,旋律优美且伴奏丰富,整体听感优于前代 3.0 Pro 版本。然而,该模型在中文支持上出现了严重的倒退。测试发现,3.5 的中文“识字率”极低,几乎无法正确识别笔画数超过 5 的汉字,导致生成的歌词充斥着大量的发音错误,严重破坏了旋律的连贯性与韵律感。相比之下,旧版 3.0 Pro 虽然人声情感较为机械,但能做到 100% 的汉字准确识别。此外,此次更新取消了普通版与 Pro 版的区分,并增强了指令遵循能力,甚至可能支持指定 BPM。鉴于中文生成的巨大缺陷,建议有中文创作需求的用户暂缓升级,或继续沿用 3.0 版本。
事件分析
💡 核心观点:谷歌音乐模型3.5以牺牲中文语义准确性换取音质提升,揭示了多模态模型在多语种平衡与高保真生成之间的技术权衡困境。
原文链接:Linux.do





