跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引

高性能计算

这个标签下有 43 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

高性能Java新方案:实现Records零开销映射至本地内存

GitHub上出现了一个高性能Java库,旨在将Java Records快速映射至本地内存,性能表现据称可比肩C代码。该库通过避免反射调用和利用逃逸分析,实现了极低的开销。讨论中提到,Java一直缺乏原生的“结构体数组”机制以支持零分配的高...

1 分钟阅读53 阅读
前沿哨所

格子玻尔兹曼算法实现37倍加速,AI Agent深度参与数学优化

GitHub上的一项关于格子玻尔兹曼圆柱流模拟的项目实现了惊人的37倍性能提升。评论区的深入讨论揭示,该项目中关于“选择有利采样时刻进行粗化处理”的关键数学洞见,是在AI Agent的辅助下完成构建与测试的。这不仅是高性能计算领域的突破,更...

1 分钟阅读50 阅读
前沿哨所

打破性能极限:利用C++23实现56ns超低延迟跨语言IPC通信

本文介绍了一种突破性的跨语言进程间通信(IPC)库,旨在实现内存级别的通信速度。该技术完全绕过内核调用,消除了序列化开销,在标准CPU上实现了56.5纳秒的P50往返延迟。其核心架构采用严格的单生产者单消费者(SPSC)拓扑,通过硬件优化的...

1 分钟阅读140 阅读
前沿哨所

性能提升25倍:深入解析无锁环形缓冲区的极致优化

本文详细剖析了单生产者单消费者(SPSC)环形缓冲区的优化过程。作者从基础的互斥锁版本(1200万次操作/秒)入手,逐步引入原子操作、精细化的内存序控制以及索引缓存策略,最终将性能提升至3.05亿次操作/秒。文章深入探讨了CPU缓存行对齐、...

1 分钟阅读190 阅读
前沿哨所

打破进程壁垒:Threadprocs实现多程序零拷贝内存共享

GitHub上的实验性项目Threadprocs提出了一种新颖的系统架构,旨在融合Posix进程的安全性与多线程的高性能。该项目允许两个或多个独立的可执行程序在同一共享地址空间中运行,使得指针在跨程序传递时依然有效,从而实现真正的零拷贝数据...

1 分钟阅读99 阅读