본문으로 건너뛰기
← 전체 뉴스
Databricks Blog2026년 10월 5일

Databricks Runtime의 NEAREST BY Join을 통한 벡터 검색 확장

영어 원문을 AI가 번역했습니다. 영어로 보기

요약

Databricks Runtime에 Lakehouse 데이터에 대해 직접 정확 또는 근사 일괄 벡터 검색을 수행하는 새로운 SQL 조인인 NEAREST BY가 도입되었습니다. 커스텀 블록화 GEMM 커널이 적용된 융합된 Photon 연산자를 기반으로 하여, 외부 벡터 저장소를 동기화하거나 관리할 파이프라인 없이 표준 liquid-clustered Delta 테이블을 파티션 프루닝된 벡터 인덱스로 변환합니다.

* NEAREST BY는 일괄 벡터 검색을 위한 새로운 SQL 조인입니다. 모든 쿼리 행에 대해 벡터 유사도 또는 거리(정확 또는 근사)를 기준으로 가장 가까운 k개의 행을 찾습니다. * 커스텀 블록화 GEMM kernel이 탑재된 융합 Photon 연산자는 하드웨어가 제공하는 최대 연산 처리량에 가깝게 거리 스코어링을 끌어올립니다. * 별도의 시스템을 동기화하거나 운영할 필요 없이 Lakehouse가 곧 벡터 저장소 역할을 합니다. IVF 벡터 인덱스는 읽기 시 대부분의 파티션을 프루닝하는 일반 liquid-clustered Delta 테이블입니다.

관련 기사

News

데이터 이동성 확보: REGISTER 및 UNREGISTER API로 카탈로그 종속 방지

databricks-blog13h ago
News

Genie Ontology가 Databricks의 제품 개발을 구동하는 방식

databricks-blog14h ago
News

자본 시장의 바이사이는 NAV로 움직이고, 재무 부서는 수수료를 보호합니다

databricks-blog3d ago
News

최대 효과를 위한 첫 Genie Agents 선정 가이드

databricks-blog3d ago