turbopuffer v3、ベクトルDB脱却へ
原題: RIP, vector database
なぜ重要か
ベクトルDB市場がRAGブームの一巡後に「汎用検索DB」へ収斂しつつある流れを、有力スタートアップが設計レベルで追認した事例として注目される。
クラウドネイティブ検索データベースのturbopufferは2026年9月30日、次世代アーキテクチャ「v3」への移行を発表した。これまでANNベクトルインデックスを主軸に置いた設計を刷新し、ベクトル検索を「二次インデックス」へ降格させる。テキスト・正規表現・ベクトル検索の高速化に加え、GROUP BYや集計などのSQLクエリにも対応範囲を拡大する。
turbopufferはエンジニアのDan Harrison氏が同社ブログで、ストレージアーキテクチャの大規模刷新計画を公表した。
同社はv1として、IDとベクトルだけで構成されるサーバーレスベクトルデータベースとして2022年頃にローンチ。オブジェクトストレージを「真実の源」として低コストを実現し、NVMe SSDとメモリのキャッシュ階層で性能を補う設計が特徴だった。この方針はCursorやNotionなど初期顧客によって有効性が検証されたという。
その後v2では全文検索・正規表現検索を強化し、Linearのデータ同期エンジンなど非検索用途にも活用が広がった。しかし根幹のストレージ設計は変わらず、階層クラスタリング型のANNインデックス(SPANNを経てSPFreshへ移行)が「プライマリインデックス」であり続けた。すべてのクエリプランがこのANNアドレス(ClusterIdとLocalIdの組)を軸に構成されていたため、GROUP BYや集計処理の実装に制約が生じていた。
v3では、ANNインデックスを「セカンダリインデックスの一つ」として再定義し、別のプライマリインデックスへ移行する。これにより、テキスト・正規表現・ベクトルの各検索をすべての面で高速化できるとしており、加えてSQLクエリの多くをturbopuffer上で直接処理できる土台を整えるとしている。同社は今後、この移行過程を順次公開していく方針を示した。