LiquidAI开源LFM2.5端侧模型,1.2B参数实现极致推理
LiquidAI推出专为端侧部署的LFM2.5系列模型,其1.2B参数版本性能媲美大模型。该模型在AMD CPU上解码速度达239 tok/s,移动NPU上达82 tok/s,内存占用低于1GB。模型基于28T令牌训练,支持llama.cp...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
LiquidAI推出专为端侧部署的LFM2.5系列模型,其1.2B参数版本性能媲美大模型。该模型在AMD CPU上解码速度达239 tok/s,移动NPU上达82 tok/s,内存占用低于1GB。模型基于28T令牌训练,支持llama.cp...