SELECT sur une table Hive dans HDFS. Actuellement, il prend en charge les formats d’entrée suivants :
-
Text : prend uniquement en charge les types de colonnes scalaires simples, à l’exception de
binary -
ORC : prend en charge les types de colonnes scalaires simples, à l’exception de
char; prend uniquement en charge les types complexes commearray -
Parquet : prend en charge tous les types de colonnes scalaires simples ; prend uniquement en charge les types complexes comme
array
Créer une table
- Les noms des colonnes doivent être les mêmes que dans la table Hive d’origine, mais vous pouvez n’en utiliser que certaines, dans n’importe quel ordre, et également utiliser des colonnes alias calculées à partir d’autres colonnes.
- Les types de colonnes doivent être les mêmes que dans la table Hive d’origine.
- L’expression de partitionnement doit être cohérente avec celle de la table Hive d’origine, et les colonnes figurant dans l’expression de partitionnement doivent être présentes dans la structure de la table.
-
thrift://host:port— Adresse du Hive Metastore -
database— Nom de la base de données distante. -
table— Nom de la table distante.
Exemple d’utilisation
Comment utiliser le cache local pour le système de fichiers HDFS
config.xml
- enable: ClickHouse maintiendra un cache local pour le système de fichiers distant (HDFS) après le démarrage si la valeur est
true. - root_dir: Obligatoire. Le répertoire racine dans lequel stocker les fichiers du cache local pour le système de fichiers distant.
- limit_size: Obligatoire. La taille maximale (en octets) des fichiers du cache local.
- bytes_read_before_flush: Définit le nombre d’octets lus avant l’écriture vers le système de fichiers local lors du téléchargement d’un fichier depuis le système de fichiers distant. La valeur par défaut est de 1MB.