本文へスキップ
← ニュース一覧
Databricks Blog2026年10月5日

Databricks RuntimeにおけるNEAREST BY Joinによるベクトル検索のスケール

英語原文から AI が翻訳しました。 英語版を見る

要約

Databricks Runtimeに新機能「NEAREST BY」が追加されました。Lakehouseデータに対して直接正確または近似的な一括ベクトル検索を実行する新しいSQLジョインです。カスタムのブロック化GEMMカーネルを備えた統合Photonオペレーターにより、外部のベクトルストアを同期・管理することなく、標準のliquid-clustered Deltaテーブルをパーティションプルーニングされたベクトルインデックスへと変換します。

* NEAREST BYは、バッチベクトル検索のための新しいSQLジョインです。クエリの各行に対して、ベクトル類似度または距離に基づいて最も近いk行を正確または近似的に検索します。 * カスタムのブロック化GEMM kernelを持つ統合Photonオペレーターにより、ハードウェアのピーク算術スループットに近い距離スコアリングを実現します。 * 別途のシステムを同期・運用する必要なく、Lakehouse自体がベクトルストアとして機能します。IVFベクトルインデックスは通常のliquid-clustered Deltaテーブルであり、読み込み時に大半のパーティションをプルーニングします。

関連記事

News

データ可搬性の向上:REGISTERおよびUNREGISTER APIによるカタログのベンダーロックイン防止

databricks-blog13h ago
News

Genie OntologyがDatabricksの製品開発をどのように支えているか

databricks-blog14h ago
News

資本市場における買収側はNAVで動き、ファイナンス部門は手数料を守る

databricks-blog3d ago
News

最大の成果を生む最初の Genie Agents の選び方

databricks-blog3d ago