跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引

CPU优化

这个标签下有 15 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

豆包输入法Mac版0.6.8发布:修复CPU占用过高bug,新增双拼支持

豆包输入法Mac端迎来了0.6.8版本更新,重点修复了此前版本中备受诟病的CPU占用过高问题,并显著提升了打字流畅度,解决了长短词跳变时的闪烁现象。功能上,新版本新增了双拼输入(支持小鹤双拼和自然码),同时引入了自动空格及符号自动替换功能,...

1 分钟阅读401 阅读
前沿哨所

巧妙利用Durable Objects突破Cloudflare Worker的CPU限制

文章指出,Cloudflare Workers免费计划虽有10ms CPU限制,但Durable Objects(DO)并无此限制,而是按时长计费。作者通过实测代码证实,将计算任务卸载至DO,可在免费计划下获得长达30秒的CPU时间。这一发...

1 分钟阅读342 阅读
前沿哨所

无需GPU,Zig语言3秒计算3300万卫星位置

作者利用Zig编程语言对SGP4卫星传播算法进行了极致优化,仅靠CPU就在3秒内完成了3300万次卫星位置计算。通过Zig的SIMD指令、编译时计算及无分支路径设计,其原生速度达到每秒1100万至1300万次,显著超越Rust等现有方案。该...

1 分钟阅读286 阅读
前沿哨所

AVX-512深度实战:为何显式SIMD比CUDA更契合LLM时代?

本文深入探讨了AVX-512的性能与可编程性,通过K-Means算法对比了手动向量化、编译器自动优化及CUDA的差异。实测显示,手动AVX-512代码虽繁琐,但实现了接近理论极限的性能,大幅领先自动向量化。文章指出,相比CUDA的抽象,显式...

1 分钟阅读244 阅读