挑战30亿向量检索:从代码优化到工程思维的本质转变
本文详细记录了作者受Jeff Dean启发,尝试实现30亿规模向量搜索的技术探索过程。通过利用NumPy向量化操作和Float32数据类型,作者成功将查询速度提升了数百倍。然而,当数据规模扩展至30亿时,系统遭遇了高达8.6PB的内存墙瓶颈...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
本文详细记录了作者受Jeff Dean启发,尝试实现30亿规模向量搜索的技术探索过程。通过利用NumPy向量化操作和Float32数据类型,作者成功将查询速度提升了数百倍。然而,当数据规模扩展至30亿时,系统遭遇了高达8.6PB的内存墙瓶颈...
该方案介绍了一款基于Hexo博客的智能推荐插件,利用OpenAI Embedding技术实现基于内容的语义搜索推荐。其核心优势在于支持结果缓存,仅当文章正文或标题变化时才重新计算,有效避免非内容修改引发的无效刷新。此外,插件采用数据分片存储...
本文深入探讨了基于嵌入模型的代码库索引技术。文章回顾了从传统grep到神经代码搜索的演变,详细解析了CodeBERT、StarCoder及OpenAI等模型的数学原理与架构。同时,介绍了基于AST的结构化代码切片技术,以及HNSW和量化等向...