サーバーレスベクトルデータベースのTurbopufferは、次期バージョンである「turbopuffer v3」において、ストレージアーキテクチャの重要な変更を発表しました。このアップデートにより、コア設計が近似最近傍探索(ANN)をプライマリインデックスとして使用する方法から、ANNを単なるセカンダリインデックスの一つとして扱う方法へと移行します。
リリース以来、turbopufferはオブジェクトストレージに最適化された階層型クラスタリングインデックスを利用しており、ドキュメントはANNアドレスによってキー付けされてきました。このアプローチにより、大規模なベクトル検索を効率的に実行できるようになりましたが、同社は、属性フィルタリングや全文検索といった非ベクトル型のクエリにおいてボトルネックになっていると述べています。
新しいアーキテクチャへの移行は、現行システムの3つの主な制限事項に対処するものです。具体的には、特にマルチベクトル表現におけるストレージ増幅、クラスタの再バランシングによって引き起こされる書き込み増幅、そして限定的なベクトル化です。現在、すべてのデータがANNアドレスに紐付けられているため、単一のベクトルを更新するだけで、大量のメタデータや関連インデックスの移動を強制してしまう可能性があります。
新しいアーキテクチャは、異なるクエリプランに合わせて最適化された、より効率的なブロックサイズを可能にすることを目指しており、これによりCPUの飽和度とSIMDの活用を向上させます。Turbopufferの報告によると、v3エンジンはCIテストを通過していますが、現在は既存の本番環境と比較した際の退行(レグレッション)を排除するためのパフォーマンスチューニングが行われている段階とのことです。
出典
- RIP, vector database (Hacker News Frontpage, 2026-10-01)