ClickHouse Cloud アーキテクチャ
- コンピュートとストレージは分離されているため、それぞれを独立した軸で自動的にスケールできます。そのため、固定的なインスタンス構成でストレージやコンピュートを過剰にプロビジョニングする必要がありません。
- オブジェクトストア上の階層型ストレージと多段のキャッシュにより、実質的に無制限のスケーリングと優れたコストパフォーマンスを実現できます。そのため、ストレージ容量を事前に見積もったり、高額なストレージコストを心配したりする必要がありません。
- 高可用性はデフォルトで有効になっており、レプリケーションも透過的に管理されるため、アプリケーションの構築やデータ分析に集中できます。
- 変動のある継続的なワークロード向けの自動スケーリングはデフォルトで有効になっているため、サービスのサイジングを事前に行ったり、ワークロードの増加時にサーバーをスケールアップしたり、アクティビティが減ったときに手動でサーバーをスケールダウンしたりする必要がありません
- 断続的なワークロード向けのシームレスな休止機能もデフォルトで有効になっています。一定期間アクティビティがない場合、コンピュートリソースは自動的に一時停止され、新しいクエリが到着すると透過的に再開されるため、アイドル状態のリソースに料金を支払う必要がありません。
- 高度なスケーリング制御により、追加コストを抑えるために自動スケーリングの上限を設定したり、特別なパフォーマンス要件を持つアプリケーション向けにコンピュートリソースを確保するため自動スケーリングの下限を設定したりできます。
機能
データベースおよびテーブルエンジン
Shared* エンジンに自動的に置き換えます。Shared または Replicated のプレフィックスを自分で付ける必要はありません。
Replicated* エンジンも、同じ対応先の Shared* エンジンに変換されます。この置き換えは SHOW CREATE TABLE で確認でき、ステートメントで通常のバリアントを指定していても、Shared* エンジンとして表示されます。
以下のテーブルエンジンもサポートされており、そのまま使用されます。サポートされている MySQL テーブルエンジンは、サポートされていない MySQL データベースエンジンとは異なります。
- URL
- View
- MaterializedView
- GenerateRandom
- Null
- Buffer
- Memory
IcebergS3およびIcebergAzure- Deltalake
- Hudi
- MySQL
- MongoDB
- NATS
- RabbitMQ
- PostgreSQL
- S3
- Kafka
PaimonS3 および PaimonAzure テーブルエンジンは、一部の ClickHouse Cloud サービスで有効にできます。利用可否についてはサポートにお問い合わせください。
インターフェイス
Dictionaries
フェデレーテッドクエリ
IcebergS3およびIcebergAzurePaimonS3およびPaimonAzure(実験的。利用可否についてはサポートにお問い合わせください)- Deltalake
- Hudi
- MySQL
- MongoDB
- NATS
- RabbitMQ
- PostgreSQL
- S3
ユーザー定義関数
Settings の挙動
- セッションレベルの設定 (
SETステートメントで設定) は、UDF の実行コンテキストに伝播されません - ユーザープロファイル設定は UDFs に継承されません
- クエリレベルの設定は、UDF の実行中には適用されません
実験的機能
名前付きコレクション
運用上のデフォルト設定と考慮事項
運用上の制限
max_parts_in_total: 10,000
max_parts_in_total 設定のデフォルト値は、100,000 から 10,000 に引き下げられました。この変更の理由は、データパーツ数が多いと Cloud 上のサービスの起動時間が長くなりやすいことが確認されたためです。パーツ数が多い場合、通常はパーティションキーの粒度が細かすぎることを示しており、これは多くの場合意図せず設定されるものであるため、避けるべきです。デフォルト値を変更することで、このようなケースをより早い段階で検出できるようになります。
max_concurrent_queries: 1,000
100 から 1000 に引き上げています。
これにより、サービスで実行できる同時クエリ数は レプリカ数 * 1,000 になります。単一レプリカのサービスでは、ティアにかかわらず最大 1000 の同時クエリがサポートされます。Scale および Enterprise tier の複数レプリカのサービスでは、レプリカごとに最大 1000 の同時クエリがサポートされます。