读锁反成性能杀手:在Apple M4实测中,Mutex竟比RwLock快5倍
这篇文章揭示了高性能并发编程中一个反直觉的硬件陷阱。作者在开发基于 Rust 的 Tensor Cache 时发现,在 Apple M4 芯片上,遵循常规直觉用于读多写少场景的读写锁(RwLock),其性能反而比普通的互斥锁(Mutex)慢...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
这篇文章揭示了高性能并发编程中一个反直觉的硬件陷阱。作者在开发基于 Rust 的 Tensor Cache 时发现,在 Apple M4 芯片上,遵循常规直觉用于读多写少场景的读写锁(RwLock),其性能反而比普通的互斥锁(Mutex)慢...