turbopuffer、ベクターDB脱却しv3発表

원제: RIP, vector database

왜 중요한가

ベクターDBが汎用クエリエンジンへと進化する動きは、専用データベース市場の再編を示す事例として注目される。

turbopufferは2026年9月30日、エンジニアのDan Harrison氏がストレージアーキテクチャを全面刷新するv3を発表した。ANNベクターインデックスを「主インデックス」から「セカンダリインデックス」へ降格させ、テキスト・正規表現・ベクター検索のすべてを高速化するとともに、GROUP BYや集計などのSQLクエリへの対応基盤を整える。

turbopufferはCursorやNotionを初期顧客として「サーバーレスベクターデータベース(v1)」として出発した。オブジェクトストレージをソース・オブ・トゥルースに据え、NVMe SSDとメモリの階層キャッシュで低コスト・高速を両立するアーキテクチャだ。v2ではテキスト・正規表現検索を強化し、Linearのsyncing engineのような非検索用途にも活用されるようになった。

しかしv1から続くストレージ設計の核心——すべてのインデックスがANNベクターインデックスを中心に構成される「ベクター主インデックス方式」——は、GROUP BYや集計クエリを制約してきた。ClusterIdとLocalIdで構成される「ANNアドレス」をプライマリキーとした設計は、ベクター検索には最適でも、汎用的なクエリエンジンには重荷となっていた。

v3ではこの設計を根本から改める。新たな主インデックスを導入し、ANNを「もう一つのセカンダリインデックス」として位置づけ直す。これにより、ドキュメント・インデックスのレイアウト、書き込み、コンパクション、クエリの各フェーズが刷新される。同社は開発の進捗を公開しながら段階的に情報を発信していく方針で、今回の投稿はその第一弾となる。

출처

turbopuffer.com — 원문 읽기 →