Databricks 博客·· 4 小时前精选AI 评分56
Databricks Runtime 推出 NEAREST BY Join 功能,优化批处理向量搜索
NEAREST BY Join: Scaling Vector Search in Databricks Runtime
AI 导读
Databricks Runtime 推出 NEAREST BY Join 功能,将向量搜索作为原生引擎特性实现,支持批处理场景下的高吞吐、低成本向量搜索。该功能通过原生 SQL 语法、SIMD 加速的向量函数、融合的 GEMM 内核和可选的 IVF 索引,实现数据在 Delta 表内统一存储与计算,避免外部向量库的同步开销。
推荐理由
原文给出了新功能的架构设计和性能优化路径,读者可以据此理解它如何提升批处理向量搜索的吞吐与成本效率。
来源:Databricks 博客 · databricks.com