SELECT em tabelas Hive no HDFS. Atualmente, ele oferece suporte aos seguintes formatos de entrada:
-
Text: oferece suporte apenas a tipos de coluna escalares simples, exceto
binary -
ORC: oferece suporte a tipos de coluna escalares simples, exceto
char; oferece suporte apenas a tipos complexos comoarray -
Parquet: oferece suporte a todos os tipos de coluna escalares simples; oferece suporte apenas a tipos complexos como
array
Criando uma tabela
- Os nomes das colunas devem ser os mesmos da tabela Hive original, mas você pode usar apenas algumas delas, em qualquer ordem; também pode usar colunas com alias calculadas a partir de outras colunas.
- Os tipos das colunas devem ser os mesmos da tabela Hive original.
- A expressão de particionamento deve ser compatível com a da tabela Hive original, e as colunas usadas nessa expressão devem estar na estrutura da tabela.
-
thrift://host:port— endereço do Hive Metastore -
database— nome do banco de dados remoto. -
table— nome da tabela remota.
Exemplo de uso
Como usar cache local para o sistema de arquivos HDFS
config.xml
- enable: O ClickHouse manterá um cache local para o sistema de arquivos remoto (HDFS) após a inicialização se true.
- root_dir: Obrigatório. O diretório raiz para armazenar os arquivos de cache local do sistema de arquivos remoto.
- limit_size: Obrigatório. O tamanho máximo (em bytes) dos arquivos de cache local.
- bytes_read_before_flush: Controla a quantidade de bytes antes do flush para o sistema de arquivos local ao baixar um arquivo do sistema de arquivos remoto. O valor padrão é 1 MB.