Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
AWS Glue を試してみたら、カスタムコネクタのありがたさを感じたこと / awsglue...
Search
Miyamotok
February 24, 2021
Technology
0
1.8k
AWS Glue を試してみたら、カスタムコネクタのありがたさを感じたこと / awsglue-custom-connector
2021/2/24 JAWS-UG TOHOKU
Miyamotok
February 24, 2021
Tweet
Share
More Decks by Miyamotok
See All by Miyamotok
Amazon Appflow で Salesforce to Snowflake へのデータローディング(EL)をやってみた / appflow-salesforce-snowflake-dataloading
miyamotok
0
490
[ELTツール×BigQuery] どのAPI使ってる?それぞれのAPIについて調べてみた / elttool-bigquery-which-api
miyamotok
0
500
ノーコード×分析基盤で複数データソースからのデータ収集を楽しようの話 / multi-saas-data-extract
miyamotok
0
350
Amazon Appflow で SaaS データ取込みを自動化してQuickSightで可視化してみた / appflow-salesforce-quicksight
miyamotok
0
5.3k
最近使ったETL、ELTサービス(ツール)でデータ収集タスクについて考える / etl-elt-datacollect-task
miyamotok
1
2.8k
_CDataSync_SaaSデータのバックアップ_.pdf
miyamotok
0
1.1k
Other Decks in Technology
See All in Technology
新機能VPCリソースエンドポイント機能検証から得られた考察
duelist2020jp
0
230
Amazon Kendra GenAI Index 登場でどう変わる? 評価から学ぶ最適なRAG構成
naoki_0531
0
130
re:Invent をおうちで楽しんでみた ~CloudWatch のオブザーバビリティ機能がスゴい!/ Enjoyed AWS re:Invent from Home and CloudWatch Observability Feature is Amazing!
yuj1osm
0
140
効率的な技術組織が作れる!書籍『チームトポロジー』要点まとめ
iwamot
1
110
バクラクのドキュメント解析技術と実データにおける課題 / layerx-ccc-winter-2024
shimacos
2
1.2k
Yahoo! ズバトクにおけるフロントエンド開発
lycorptech_jp
PRO
0
100
普通のエンジニアがLaravelコアチームメンバーになるまで
avosalmon
0
120
Qiita埋め込み用スライド
naoki_0531
0
5.3k
[JAWS-UG新潟#20] re:Invent2024 -CloudOperationsアップデートについて-
shintaro_fukatsu
0
120
podman_update_2024-12
orimanabu
1
290
[トレノケ雲の会 mod.13] 3回目のre:Inventで気づいたこと -CloudOperationsを添えて-
shintaro_fukatsu
0
110
Working as a Server-side Engineer at LY Corporation
lycorp_recruit_jp
0
370
Featured
See All Featured
The Art of Delivering Value - GDevCon NA Keynote
reverentgeek
8
1.2k
Build The Right Thing And Hit Your Dates
maggiecrowley
33
2.4k
XXLCSS - How to scale CSS and keep your sanity
sugarenia
248
1.3M
GitHub's CSS Performance
jonrohan
1031
460k
Documentation Writing (for coders)
carmenintech
67
4.5k
How GitHub (no longer) Works
holman
311
140k
RailsConf & Balkan Ruby 2019: The Past, Present, and Future of Rails at GitHub
eileencodes
132
33k
Performance Is Good for Brains [We Love Speed 2024]
tammyeverts
6
520
We Have a Design System, Now What?
morganepeng
51
7.3k
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
127
18k
Raft: Consensus for Rubyists
vanstee
137
6.7k
For a Future-Friendly Web
brad_frost
175
9.4k
Transcript
AWS Glue を試してみたら、カ スタムコネクタのありがたさを 感じたこと JAWS-UG TOHOKU 2021/02/24 CData Software
Japan 宮本
自己紹介 宮本 航太(@miyamon44) CData Software Japan 合同会社 CData Syncを年中触ってる人 普段は製品サポートを中心に、開発、他社サービスと
の検証 これからAWSと仲良しになりたいので、 今はお気に入りになりそうなサービスを調査中
CData Glue Connectors Release!!
リリースするのは知っていたけど・・・ ぐるー? 名前は聞いたこと あるけど?
ちょっと調べてみた 公式ページより、 ‘‘分析、機械学習、アプリケーション開発のためのデータの検出、準備、結 合を簡単に行える、サーバーレスデータ統合サービス’’ AWS上のETLサービス データパイプラインの作成が可能
ざっくりこんなイメージ 店舗ごとの売上デー タ データレイク データマート 変換 売上分析
データパイプラインの作成の前に・・ AWS Glue Studio というのがなんか 新機能っぽいぞ 実際にやってみる
‘‘AWS Glue Studio は、AWS Glue で抽出、変換、およびロード (ETL) ジョブの作成、実行、 監視を容易にする新しいグラフィカルインターフェイスです。’’ AWS
Glue Studio
キャンバス上でポチポチデータパイプラインを作成するなら 「Blank graph」を選択する Jobの作成
+でNodeを追加 ▪対応データソース S3、Kinesis、Kafka、JDBC、Redshift ▪変換処理 データマージやマッピングなど カスタムで定義可 ▪連携先 S3、AWS Glue Data
Catalog Jobの作成
フローを定義するとコード(Python)が生成される
実行
ここでちょっと思った お、GUIでデータパイプラインの定義 ができるのはよさげ。 けど、ETLならSaaS のデータも取得し たいんだけどなぁ。 自分で実装するのは辛し。
データソース DB DB DB DWH ETLおさらい(従来のETL) 変換 ロード 社内システム毎に保持 してるデータ
データソース DB DB DB DWH ETLおさらい 変換 ロード ETL:Extract Transform
Load の略 データを抽出して → 変換して → ターゲットDBにロードする という構成のこと
データソース 最近よくみるETLツール・サービスはこんな感じ 変換 ロード
ざっくりこんなイメージ(SaaSデータ版) SaaS データマート 変換 SaaSを横断したデー タ活用 コードを書かずGUIだけでこの構成を作りたい!
どうやってSaaSに接続するのか? 最近の話⇒ コネクタをサブスクライブ! 以上!
コネクタをサブスクライブしたら 例えば CData AWS Glue Connector for Salesforce を 登録したら、Node
type に表示 され選択できる
Salesforce から S3 へ S3を軸に、これまで以上に色んなサービ スやツールでのデータ活用が活性化さ れる DB
・Glue でカスタムコネクタというものが提供開始されてた ・SaaS をソースとしたデータパイプライン作成が容易 ・S3を軸としたデータ活用が更に活性化されそう まとめ Thank you!