跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 2 页

CPU优化

这个标签下有 15 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

Pocket TTS发布:无需GPU的高质量CPU语音合成模型

Kyutai实验室推出了名为Pocket TTS的新一代文本转语音模型,其核心突破在于能够在不依赖昂贵GPU的情况下,于普通CPU上实现高质量的语音合成。该模型不仅大幅降低了AI语音技术的硬件部署成本,还显著提升了端侧设备的运行效率。通过优...

1 分钟阅读399 阅读
前沿哨所

AI推理优化:运行时间独立于规则数量

作者通过实验展示,在单通道边界执行模型中,每条记录的运行时间与编译的义务数量无关。这意味着处理JSON等结构化数据时,请求可在昂贵计算(如解析、标记化、模型嵌入)前被丢弃,从而显著减少令牌生成、CPU周期和大规模成本。实验代码已在GitHu...

1 分钟阅读233 阅读
前沿哨所

C++生产环境性能分析:解决火焰图符号表缺失问题

文章探讨了C++生产环境中使用perf工具进行CPU性能分析时遇到的符号表缺失问题,导致火焰图无法显示具体方法名,影响调试效率。作者作为初学者,分享了临时解决方案如重新编译带符号表版本,并询问生产环境采火焰图的最佳实践。回答建议让生产环境有...

1 分钟阅读130 阅读
前沿哨所

Docker容器防结束:最佳实践比较

在创建Docker镜像时,防止容器结束运行是常见需求。本文深入比较了三种方法:运行’sleep infinity’、’tail -f /dev/null’和挂载’/pause&#8...

2 分钟阅读175 阅读
前沿哨所

小型哈希表的极致优化:Robin Hood探查法

本文详细介绍了一种名为’Robin Hood open-addressing’的高效哈希表设计,结合线性探查和2的幂次表大小,实现了卓越的性能。文章提供了完整的C语言实现代码,包括查找、插入、删除和遍历操作,并探讨了...

1 分钟阅读271 阅读