Aller au contenu
← Toutes les actus
Databricks Blog5 octobre 2026

NEAREST BY Join : mise à l'échelle de la recherche vectorielle dans Databricks Runtime

Traduit de l'original anglais par IA. Voir en anglais

Résumé

Databricks Runtime intègre désormais NEAREST BY, une nouvelle jointure SQL qui exécute des recherches vectorielles par lot exactes ou approximatives directement sur vos données Lakehouse. Propulsée par un opérateur Photon fusionné doté d'un noyau GEMM bloqué personnalisé, elle transforme les tables Delta standard liquid-clustered en index vectoriels élagués par partition, sans nécessiter de magasin de vecteurs externe à synchroniser ou gérer.

* NEAREST BY est une nouvelle jointure SQL pour la recherche vectorielle par lot : pour chaque ligne de requête, elle trouve les k lignes les plus proches par similarité vectorielle ou distance (exacte ou approximative). * Un opérateur Photon fusionné avec un GEMM kernel bloqué personnalisé pousse le calcul des scores de distance vers le débit arithmétique maximal offert par le matériel. * Votre Lakehouse fait également office de magasin de vecteurs, sans système séparé à synchroniser ou exploiter : l'index vectoriel IVF est une table Delta liquid-clustered ordinaire qui élague la plupart des partitions lors de la lecture.

Articles similaires

News

Libérer la portabilité des données : prévenir le verrouillage de catalogue avec les API REGISTER et UNREGISTER

databricks-blog13h ago
News

Comment Genie Ontology propulse le développement de produits chez Databricks

databricks-blog14h ago
News

Sur les marchés financiers, le côté acheteur fonctionne au NAV. La finance protège les frais.

databricks-blog3d ago
News

Comment choisir vos premiers Genie Agents pour un impact maximal

databricks-blog3d ago