Почему CONCAT_WS в PostgreSQL часто лучше обычной конкатенации строк!Есть такие SQL-функции, которые вроде бы выглядят слишком простыми, чтобы о них писать отдельный пост. Но именно они часто убирают кучу мелких проблем в реальных проектах,
CONCAT_WS — хороший пример.
Когда работаешь с тестовыми данными, кажется, что собрать строку очень просто. Есть имя, фамилия, отчество — соединяем их через пробел и получаем красивый результат.
Обычно первый вариант выглядит так:
SELECT
first_name || ' ' || middle_name || ' ' || last_name AS full_name
FROM users;
На первый взгляд всё нормально. Но потом база начинает жить настоящими данными. У одного пользователя нет отчества. У другого не заполнена фамилия. После миграции часть полей приходит пустыми. И вот здесь простой запрос начинает вести себя не так, как ожидает разработчик.
Например:
first_name = 'John'
middle_name = NULL
last_name = 'Smith'
Кажется логичным получить:
John Smith
Но PostgreSQL вернёт:
NULL
Причина в том, что NULL — это не пустое значение. Это отсутствие значения. При обычной конкатенации строк неизвестная часть делает неизвестным весь результат.
Конечно, можно начать добавлять
COALESCE:
SELECT
first_name || ' ' ||
COALESCE(middle_name || ' ', '') ||
last_name
FROM users;
Для двух-трёх полей это ещё нормально. Но в реальном запросе таких частей может быть намного больше: адрес, название компании, описание товара, дополнительные параметры.
И постепенно вместо простой сборки строки появляется большая конструкция из проверок.
В PostgreSQL для таких задач есть более удобный вариант:
SELECT
CONCAT_WS(
' ',
first_name,
middle_name,
last_name
) AS full_name
FROM users;
CONCAT_WS расшифровывается как "concatenate with separator". Первый аргумент — разделитель, который нужно использовать между значениями.
Главная особенность в том, что функция сама пропускает NULL. То есть:
John + NULL + Smith
превратится в:
John Smith
а не в строку с лишним пробелом или неожиданный NULL.
На практике это особенно удобно, когда собираете данные для отображения пользователю. Например, адрес:
Germany, Berlin, Alexanderplatz 10
может состоять из нескольких частей, но квартира или дополнительный номер могут отсутствовать. Не хочется писать отдельные проверки для каждого поля только ради красивого вывода.
Но есть нюанс, который часто забывают.
CONCAT_WS пропускает NULL, но пустую строку считает настоящим значением.
Например, после загрузки данных из CSV можно получить:
middle_name = ''
Для пользователя это выглядит так же, как отсутствие значения. Но PostgreSQL различает эти случаи. В результате можно получить:
John Smith с двойным пробелом.
Поэтому в системах, где данные приходят из разных источников, часто сначала нормализуют значения:
NULLIF(middle_name, '')
После этого пустые строки становятся NULL, и
CONCAT_WS уже работает предсказуемо. На небольших примерах это кажется мелочью. Но когда у тебя несколько миллионов записей и данные собираются из разных сервисов, именно такие детали начинают влиять на качество данных и количество лишнего кода.
🔥
CONCAT_WS — хороший пример того, как правильный инструмент делает SQL проще. Если нужно собрать строку из нескольких необязательных полей — часто лучше использовать её, чем вручную обрабатывать каждый NULL.
➡️ SQL Ready | #практика