Внешние Данные для Обработки Запросов
ClickHouse позволяет отправлять серверу данные, необходимые для обработки запроса, вместе с запросом SELECT
. Эти данные помещаются во временную таблицу (см. раздел "Временные таблицы") и могут использоваться в запросе (например, в операторах IN
).
Например, если у вас есть текстовый файл с важными идентификаторами пользователей, вы можете загрузить его на сервер вместе с запросом, который использует фильтрацию по этому списку.
Если вам нужно выполнить более чем один запрос с большим объемом внешних данных, не используйте эту функцию. Лучше заранее загрузить данные в БД.
Внешние данные можно загружать с помощью клиентского приложения командной строки (в нечувствительном режиме) или с помощью HTTP интерфейса.
В клиентском приложении командной строки вы можете указать секцию параметров в формате
Вы можете иметь несколько таких секций, для числа передаваемых таблиц.
–external – Отмечает начало клаузулы.
–file – Путь к файлу с дампом таблицы или -, что относится к stdin.
Можно извлечь только одну таблицу из stdin.
Следующие параметры являются необязательными: –name – Имя таблицы. Если опущено, используется _data.
–format – Формат данных в файле. Если опущено, используется TabSeparated.
Один из следующих параметров обязателен: –types – Список типов столбцов, разделенных запятыми. Например: UInt64,String
. Столбцы будут названы _1, _2, ...
–structure – Структура таблицы в формате UserID UInt64
, URL String
. Определяет имена и типы столбцов.
Файлы, указанные в 'file', будут разобраны форматом, указанным в 'format', с использованием типов данных, указанных в 'types' или 'structure'. Таблица будет загружена на сервер и доступна там как временная таблица с именем в 'name'.
Примеры:
При использовании HTTP интерфейса внешние данные передаются в формате multipart/form-data. Каждая таблица передается как отдельный файл. Имя таблицы берется из имени файла. Параметры name_format
, name_types
и name_structure
передаются в query_string
, где name
– имя таблицы, соответствующее этим параметрам. Значение параметров такое же, как и при использовании клиентского приложения командной строки.
Пример:
Для распределенной обработки запросов временные таблицы отправляются на все удаленные серверы.