← 전체 뉴스
Databricks Blog2026년 10월 5일
Databricks Runtime의 NEAREST BY Join을 통한 벡터 검색 확장
영어 원문을 AI가 번역했습니다. 영어로 보기
요약
Databricks Runtime에 Lakehouse 데이터에 대해 직접 정확 또는 근사 일괄 벡터 검색을 수행하는 새로운 SQL 조인인 NEAREST BY가 도입되었습니다. 커스텀 블록화 GEMM 커널이 적용된 융합된 Photon 연산자를 기반으로 하여, 외부 벡터 저장소를 동기화하거나 관리할 파이프라인 없이 표준 liquid-clustered Delta 테이블을 파티션 프루닝된 벡터 인덱스로 변환합니다.
* NEAREST BY는 일괄 벡터 검색을 위한 새로운 SQL 조인입니다. 모든 쿼리 행에 대해 벡터 유사도 또는 거리(정확 또는 근사)를 기준으로 가장 가까운 k개의 행을 찾습니다. * 커스텀 블록화 GEMM kernel이 탑재된 융합 Photon 연산자는 하드웨어가 제공하는 최대 연산 처리량에 가깝게 거리 스코어링을 끌어올립니다. * 별도의 시스템을 동기화하거나 운영할 필요 없이 Lakehouse가 곧 벡터 저장소 역할을 합니다. IVF 벡터 인덱스는 읽기 시 대부분의 파티션을 프루닝하는 일반 liquid-clustered Delta 테이블입니다.
