发生了什么
Google Cloud 公布了 AlloyDB 的 ScaNN 索引的一项架构增强:一个四层树,目前处于预览阶段,可在 10 billion 向量的规模下高效运行。
早期的两层和三层树设计在此规模下遇到瓶颈,包括计算强度增加以及为 10 billion 向量进行采样所需的内存限制。
新的自顶向下架构引入了 Top-K 分支、SOAR、质心调整和平衡树形状等改进,以保持准确性和构建效率。
为何重要
Agentic AI 应用通常将向量数据库推向 billions of vectors,许多系统在此类需求下难以有效扩展。
通过分层分区减少计算负载并优化内存使用,AlloyDB 旨在提供企业级性能,在空前规模下实现低查询延迟和高召回率。
关键事实
AlloyDB 是一项完全托管的、与 PostgreSQL 兼容的数据库服务,专为要求苛刻的企业工作负载而设计。
得益于四层树架构,ScaNN 索引现在可在 10 billion 向量的规模下高效运行。
内部性能测试报告在 10 billion 向量下,召回率为 95%,p95 延迟不超过 51 ms。
四层分层设计将搜索复杂度降低到 O(N^1/4),从而支持超过 10 billion 向量。
下一步关注
由于四层树仍处于预览阶段,企业可能会关注其走向正式可用和生产就绪的路径。
未来的发展可能会集中在随着向量数据集持续增长超过 10 billion 向量时保持延迟和召回率。
