---
title: GCS バケット
description: GCS バケットを接続して同期の動作を把握し、書き込まれるすべてのテーブルと列をクエリします。
species: reference
---
# GCS バケット

バケットのパス、書き込み先スキーマ、ファイルオプションを指定して GCS バケットを接続します。このソースは JSON、CSV、Parquet ファイルから検出したテーブルを `titan.{schema_name}` に書き込みます。
## GCS バケットを接続する

1. **アプリ**を開き、**アプリを接続**を選択してから、**GCS バケット**を選択します。
2. バケットのパス、書き込み先スキーマ、ファイルオプションを入力します。
3. テーブルを確認してからソースを保存します。
4. 初回の実行が完了するまで**同期履歴**を確認します。

認証情報はシークレットとして保存されます。レイクの列になったり、クエリ結果に表示されたりすることはありません。

## 同期の動作

検出したファイルのグループごとにテーブルが作成されます。ID 列と区切り文字を選び、必要に応じてファイルの glob パターンとパーティションの並べ替え列を指定します。圧縮ファイルの拡張子がその形式の標準と異なる場合は、`**/*.gz` などのカスタム glob パターンを使ってください。秒単位でパーティション分割したソースでは、増分同期時にカーソルの直前のパーティションも再確認します。この範囲を限定した重複読み取りにより、生成側が辞書順で次のパーティションを開いた後に到着したオブジェクトも取得できます。設定した ID 列が安定していれば、行の処理は冪等性を保ちます。

新しいソースは接続時に同期し、その後はスケジュールに従います。デフォルトの繰り返し間隔は 4 時間です。実行が中断しても、完了した進捗を保持して安全に再試行します。

すべてのレイクのテーブルには[システム列](/docs/concepts/your-lake#システム列) `_synced_at` と `_deleted` もあります。以下の列リファレンスにはソースの列のみを記載しています。

## テーブルリファレンス

Supernova は接続したアカウントからこのリファレンスの情報を検出します。設定したバケットのプレフィックスからヘッダーとサンプルを読み取るため、列リファレンスはそのファイルの内容によって決まります。

初回の検出が完了したら、**アプリ → GCS バケット → テーブル**を開き、すべての正確なテーブル名、列名、型、同期対象を確認します。アカウントを接続するまでは、動的なフィールドを正確に一覧化できません。

## 削除と履歴

行はソースのキーでマージされます。ソース側で行の削除を確認できた場合、Supernova は行を残して `_deleted` を設定します。クエリで履歴を含めるかどうかを選べます。現在の状態だけを取得するには `where not _deleted` で絞り込んでください。
