Spark 4.2 добавил векторный поиск прямо в движок данных
Spark 4.2, выпущенный 14 июля 2026 года, добавил в SQL векторные функции и новый механизм nearest-by join для top-K поиска ближайших соседей. Для команд, которые собирают RAG, поиск по embeddings и AI-сервисы поверх уже существующего data lake, это выглядит как попытка превратить Spark из ETL-комбайна в площадку, где можно не только готовить данные, но и обслуживать часть AI-нагрузки. Об этом сообщает The New Stack, и сам повод действительно не проходной. В релизе Apache Spark 4.2 разработчики закрыли более 1700 Jira-задач при участии свыше 250 контрибьюторов...