跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引

模型压缩

这个标签下有 8 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

谷歌发布TurboQuant技术:以极致压缩重新定义AI运行效率

谷歌Research推出名为“TurboQuant”的新型AI压缩技术,旨在通过极致的算法优化解决大模型部署的算力瓶颈。该技术能够在保持模型高精度的同时,显著降低模型体积与内存占用,从而大幅提升推理速度并降低能耗。TurboQuant不仅有...

1 分钟阅读183 阅读
前沿哨所

仅9M参数!作者训练浏览器端小模型精准纠正中文声调

作者为解决中文声调学习难题,基于Conformer和CTC技术训练了一款小型语音模型。通过数据优化与架构调整,模型参数从7500万压缩至900万,量化后仅11MB,可在浏览器端流畅运行,验证了边缘AI在特定教育场景下的高性价比与实用性。 原...

1 分钟阅读149 阅读
前沿哨所

彩票假说:神经网络剪枝实现90%参数压缩

该研究由Jonathan Frankle和Michael Carbin提出’彩票假说’,揭示了一个重要发现:通过标准剪枝技术可以从随机初始化的密集神经网络中提取出稀疏子网络(’中奖彩票’)。这...

1 分钟阅读222 阅读
前沿哨所

AI模型突破:224倍压缩Llama-70B,精度提升

研究人员开发了一种创新方法,通过低秩’意义场’技术替换完整Transformer推理,将冻结的Llama-3.3-70B模型压缩224倍,同时实现256维场表示,并在多个基准测试上略微提高准确性。该方法引入小型学生模...

1 分钟阅读201 阅读