商汤SenseNova U1技术报告出炉:全面摒弃VAE,回归原生像素生成
商汤科技正式发布了文生图模型SenseNova U1的技术报告,展示了其在模型架构上的颠覆性创新。该模型首次采用了NEO-Unify统一架构,彻底摆脱了行业通用的VAE(变分自编码器),实现了“像素输入、像素输出”的原生像素生成,有效解决了...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
商汤科技正式发布了文生图模型SenseNova U1的技术报告,展示了其在模型架构上的颠覆性创新。该模型首次采用了NEO-Unify统一架构,彻底摆脱了行业通用的VAE(变分自编码器),实现了“像素输入、像素输出”的原生像素生成,有效解决了...
DeepSeek发布最新研究成果“Engram”,提出通过可扩展查找实现条件记忆。该论文探索了大语言模型稀疏性的新维度,旨在优化模型的记忆机制与检索效率,为解决长上下文处理和计算资源消耗问题提供了新的技术路径,代码已在GitHub开源。 原...
自2016年以来,无论是GPT-5、Claude还是Gemini,所有主流Transformer模型均沿用单一残差连接设计 $x + F(x)$。本文深入探讨了DeepSeek提出的mHC架构,该设计大胆挑战了这一传统范式,通过拓宽残差连接...