メインコンテンツへ移動
Analytics分析初級CLF-C02SAA-C03

Athena

Amazon Athena

S3に置いたログやCSVをSQLで調べるためのサービス。

一言でいうと

S3に置いたログやCSVをSQLで調べるためのサービス。

概要

Amazon Athenaは、S3上のデータに対してSQLで分析できるサーバーレスクエリサービスです。

主な用途

  • S3ログ分析
  • CSVやParquetの簡易分析
  • データレイク上のアドホッククエリ

CLF-C02 試験ポイント

  • サーバーレスな分析サービスである
  • S3上のデータをSQLで検索できる
  • スキャン量に応じた課金が発生する

SAA-C03 試験ポイント

  • データ形式をParquetなどにするとスキャン量を削減できる
  • Glue Data Catalogと組み合わせてテーブル定義を管理する
  • CloudFrontやS3ログ分析の候補になる

実際の使いどころ

Amazon Athena は、S3 に保存されたデータに対して標準 SQL でクエリを実行できる サーバーレスの分析サービスである。事前にデータベースサーバーをプロビジョニングする 必要がなく、データを S3 に置き、Glue Data Catalog 等でテーブル定義を登録するだけで すぐにクエリを実行できる。実務では、CloudFront や ALB のアクセスログ分析、CloudTrail の 監査ログ分析、CSV や JSON 形式で蓄積された業務データのアドホック調査、データレイク上 でのデータ探索といった用途で使われる。 Athena のコストはクエリでスキャンした S3 データ量に対して課金される(1 TB あたり数 USD 程度)。このため、データ形式とパーティショニングの設計がコスト最適化の中心的な課題に なる。CSV や JSON のような行指向フォーマットを、Parquet や ORC のような列指向 フォーマットに変換すると、必要なカラムだけを読み出せるためスキャン量が大幅に減る。 また、日付やリージョンなど検索条件に頻出するキーでパーティションを切ると、不要な パーティションのスキャンを Athena 側で自動的にスキップできる。Glue Data Catalog で テーブル定義(スキーマとパーティション情報)を集中管理し、Athena と他の分析サービス (Redshift Spectrum、EMR など)で共有する設計が標準的である。 CLF-C02 / SAA-C03 では、「S3 上のデータを SQL で分析できるサーバーレスサービス」という 形で問われる。EMR(マネージド Hadoop/Spark)や Redshift(データウェアハウス)との 使い分けも頻出で、Athena はアドホックなクエリ・小〜中規模のログ分析向き、EMR は大規模 バッチ処理向き、Redshift は定常的な BI 分析向きという棲み分けを覚えておくと判断しやすい。

公式ドキュメント

コスト注意点

  • クエリでスキャンしたデータ量に応じて課金される
  • 不要な全件スキャンを避ける

セキュリティ注意点

  • S3バケット権限とAthena実行権限を分ける
  • クエリ結果保存先のS3権限を管理する

関連サービス

関連する比較記事

この用語には、まだ関連比較記事が登録されていません。

関連する構成図

この用語には、まだ関連構成図が登録されていません。

タグ

analyticsserverlesssqls3

最終更新日:2026-06-07