商汤日日新大模型引发社区实测:原生多模态究竟有何突破?
商汤科技的“日日新”大模型凭借其原生多模态特性成为技术社区关注的焦点。不同于传统的模型拼接方案,原生多模态旨在从底层实现文本、图像与声音的深度融合。该讨论聚集了多位开发者和科技爱好者,针对模型的技术边界与实际应用效果进行了初步探讨。这标志着...
标签索引
这个标签下有 2 篇文章。按时间回看相关判断与实践记录。
标签精选
商汤科技的“日日新”大模型凭借其原生多模态特性成为技术社区关注的焦点。不同于传统的模型拼接方案,原生多模态旨在从底层实现文本、图像与声音的深度融合。该讨论聚集了多位开发者和科技爱好者,针对模型的技术边界与实际应用效果进行了初步探讨。这标志着...
据社区爆料,一位疑似DeepSeek运维人员在小红书回应提问时,暗示DeepSeek V4可能已具备原生多模态能力。相比于目前DeepSeek普遍采用的“外挂OCR”视觉方案,此次回应中的“看见我”表述,被解读为新模型将实现视觉与语言的端到...