Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Googleのデータ解析サービス「BigQuery」の凄さ
Search
Sponsored
·
Ship Features Fearlessly
Turn features on and off without deploys. Used by thousands of Ruby developers.
→
Youkey
August 25, 2018
Technology
660
0
Share
Googleのデータ解析サービス「BigQuery」の凄さ
Let`s BBQ
Youkey
August 25, 2018
More Decks by Youkey
See All by Youkey
GCPUGOsaka_12.pdf
yukinakata
1
69
GCPUGOsaka_11.pdf
yukinakata
0
260
About Fenrir Inc.
yukinakata
0
80
Alibaba Cloud DataV handson 2019/03/07
yukinakata
0
440
Origin of the Our Service's name.
yukinakata
0
1k
How about the DataWorks(AliCloud) to easily ?
yukinakata
0
380
Report of TCC2018
yukinakata
0
250
TCCtour agenda for AliEatersOsaka
yukinakata
1
360
スマートシティを支えるAlibabaCloudAI
yukinakata
0
290
Other Decks in Technology
See All in Technology
開発にAIを組織として取り入れる一歩目とその後
yujishibuya
0
220
コーディングエージェントはTypeScriptの 型エラーをどう自己修正しているのか
melonps
4
490
EdgeプロファイルでAWSアカウントを安全に使い分ける
jhashimoto
0
110
管理アカウント単一運用からAWS Organizationsに移行するの大変で滅
hiramax
0
240
AI時代から振り返るTerraform drift運用の歴史 / AI Age Reflections on the History of Terraform Drift Operations
aeonpeople
0
390
実践 TanStack Start ― 新規プロダクトを開発して確立した、サーバーとクライアント境界の設計パターン / Practical TanStack Start Server-Client Boundary Patterns
kaminashi
2
320
【禁断】Obsidianの第二の脳に「知の巨人」と呼ばれた師匠の脳をロードしてみた
nagatsu
0
6.5k
Kaggle未経験社員をメダリストに育てる「AIドラゴン桜」
lycorptech_jp
PRO
0
570
Copilot CLI・IDE・Web・スマホで途切れない開発フローを目指して / One Copilot flow - CLI IDE Web Mobile
aeonpeople
1
1k
キャリア25年目にしてTypeScript に出会うまで - 「型」を通じて振り返るプログラミング言語遍歴 / Meeting TypeScript After 25 Years in Tech - Looking Back at My Programming Language Journey Through "Types"
bitkey
PRO
2
280
NFLコンペ2026 解法
lycorptech_jp
PRO
0
110
テストコードのないプロジェクトにテストを根付かせる
tttol
0
160
Featured
See All Featured
Connecting the Dots Between Site Speed, User Experience & Your Business [WebExpo 2025]
tammyeverts
11
920
The Cult of Friendly URLs
andyhume
79
6.9k
I Don’t Have Time: Getting Over the Fear to Launch Your Podcast
jcasabona
34
2.7k
Why Our Code Smells
bkeepers
PRO
340
58k
We Analyzed 250 Million AI Search Results: Here's What I Found
joshbly
1
1.3k
What’s in a name? Adding method to the madness
productmarketing
PRO
24
4k
The #1 spot is gone: here's how to win anyway
tamaranovitovic
2
1.1k
StorybookのUI Testing Handbookを読んだ
zakiyama
31
6.7k
Kristin Tynski - Automating Marketing Tasks With AI
techseoconnect
PRO
0
250
Technical Leadership for Architectural Decision Making
baasie
3
380
Groundhog Day: Seeking Process in Gaming for Health
codingconduct
0
190
職位にかかわらず全員がリーダーシップを発揮するチーム作り / Building a team where everyone can demonstrate leadership regardless of position
madoxten
62
54k
Transcript
Copyright © 2018 Cavity.LLC All Rights Reserved. Googleのデータ解析サービス 「BigQuery」の凄さ 2018/08/25(sat)
GCPUG Wakayama x Osaka #1
Copyright © 2018 Cavity.LLC All Rights Reserved. Let’s BBQ 2018/08/25(sat)
GCPUG Wakayama x Osaka #1
すみか:ビッグデータ解析のコンサル会社経営(副業) Cavity LLC. Co-Founder (Principal) GCP歴: 1年半(= BQ暦 ) しゅみ:分析解析での失敗
/ アボカド育てて食う Who am I ? 中田 祐樹 / Yuki Nakata ◦ 本業はGMOクラウド(株)のプリセールス ◦ 組込プログラマからSIerでSEを経て、BigQueryにはまる ◦ 計算社会科学が好きだけど、無免許データエンジニア
Copyright © 2018 Cavity.LLC All Rights Reserved. About us ➢
社名 : Cavity合同会社(英:Cavity.LLC) ➢ 本社 : 滋賀県東近江市林町 ➢ 代表社員 : 中田 祐樹(youkey:CEO/CTO)・小野 寛徳(nickson:COO) ➢ 設立 : 平成30年4月20日 ➢ 資本金 : 10円 ➢ 事業内容 : ビッグデータコンサルティング事業 ・ IaaSを用いたデータ活用コンサルティング ・ イベント運営、コミュニティ形成支援 ・ その他上記付帯事業、各種営業代行
Copyright © 2018 Cavity.LLC All Rights Reserved. Mission Statement 企業に眠るデータ資産を 「溜めるだけ」から「価値を生み出すもの」に変換す
る支援を行います。 あらゆる人がデータ活用を「当たり前に」行う社会へ の発展に貢献します。
Copyright © 2018 Cavity.LLC All Rights Reserved. AliEaters Osaka #2
2018/10/04(thu) 19:00 GMO yours大阪支社( B23F ) ・東京や札幌、福岡始まった Alibaba Cloud UGの大阪版 ・CavityはDataVで(大人の事情) ・非エンジニアもOK ・中国市場の話とか満載
Copyright © 2018 Cavity.LLC All Rights Reserved. データ可視化・分析してますか?
Copyright © 2018 Cavity.LLC All Rights Reserved. やりたかった事 非エンジニアが全くといっていいほど、分析をしない環境 DBって見づらいよね?を言い訳に、分析してもらえない環境
サーバのログで業務部隊に資料を作って貰おうとしたら、拒否
Copyright © 2018 Cavity.LLC All Rights Reserved. やりたかった事 非エンジニアが全くといっていいほど、分析をしない環境 DBって見づらいよね?を言い訳に、分析してもらえない環境
サーバのログで業務部隊に資料を作って貰おうとしたら、拒否 これを打破したい (無理な形であっても)
Copyright © 2018 Cavity.LLC All Rights Reserved. モチベーションは、 無理やり
Copyright © 2018 Cavity.LLC All Rights Reserved. そう、皆が 分析が出来ると So
Happy
Copyright © 2018 Cavity.LLC All Rights Reserved. だが、正直難しい データウェアハウスやBIはプロダクト差がえぐい・・・
Copyright © 2018 Cavity.LLC All Rights Reserved. あげく、遅い
Copyright © 2018 Cavity.LLC All Rights Reserved. なので 非エンジニアは 使わない
Copyright © 2018 Cavity.LLC All Rights Reserved. 仕方なく E◦celで渡すと 壊す
Copyright © 2018 Cavity.LLC All Rights Reserved. せめて、勉強は 統計分析のみ
Copyright © 2018 Cavity.LLC All Rights Reserved. そうだ、 Platformに頼ろう
Copyright © 2018 Cavity.LLC All Rights Reserved. そうすれば データ解析だけで 生きていける
Copyright © 2018 Cavity.LLC All Rights Reserved. BBQ : Business
Big Query 単一の商材としてではなく、ビジネスパーソンの標準スキルセットとして「ビッグデー タ解析」がある世の中を創造していきたい。 ビッグデータにまつわるツールがオフィスソフトレベルで浸透し、誰もが簡単に使え る社会を実現する ※海岸の肉焼きリア充やモンハンの身内こんがり肉作成タイムじゃないっす この活動に名前をつける
Copyright © 2018 Cavity.LLC All Rights Reserved. 本日はBigQueryの話です
Copyright © 2018 Cavity.LLC All Rights Reserved. GCP ? Googleが提供するプラットフォーム上にあるサービス群。
何がすごいって・・・ 公式ドキュメント 参照! 僕は関係あるとこだけ
Copyright © 2018 Cavity.LLC All Rights Reserved. GCP de データ解析
Produce Move Store Preprocess Analyze Watch over next
Copyright © 2018 Cavity.LLC All Rights Reserved. GCP de データ解析
Produce Move Store Preprocess Analyze Watch over next パイプライン
Copyright © 2018 Cavity.LLC All Rights Reserved. パイプライン? 複数のサービスをつなぎ、目的のビジネスロジックを完成させる ex.)
GCE + Pub/Sub + Cloud storage ex.) Bigtable + Dataproc + Bigquery + 3rd-party BI product 手段は選びません
Copyright © 2018 Cavity.LLC All Rights Reserved. パイプライン? 複数のサービスをつなぎ、目的のビジネスロジックを完成させる ex.)
GCE + Pub/Sub + Cloud storage ex.) Bigtable + Dataproc + Bigquery + 3rd-party BI product 便利なものは何でも使う
Copyright © 2018 Cavity.LLC All Rights Reserved. パイプライン? 複数のサービスをつなぎ、目的のビジネスロジックを完成させる ex.)
GCE + Pub/Sub + Cloud storage ex.) Bigtable + Dataproc + Bigquery + 3rd-party BI product Dataflowもpipeline serviceだけど ここでは便宜上、 パイプライン = データパイプライン
Copyright © 2018 Cavity.LLC All Rights Reserved. BigQuery ? 高速かつ高スケーラビリティでコスト効率に優れた エンタープライズ向け、フルマネージドデータ
ウェアハウス #最近UIが急に統合され、戸惑う人多数でしたが... 何も考えなくていい、 データウェアハウス
Copyright © 2018 Cavity.LLC All Rights Reserved. BigQuery ? 分析基盤を準備する必要が無いので、早く始められます 毎月、1TBの分析が無料枠があるけど、中々減りません
毎月、10GBのデータ保存が無料枠があり、練習用には楽々 あとは、Not Bigでも自分のデータがあればOK まずはBQでデータ解析が学べます
Copyright © 2018 Cavity.LLC All Rights Reserved. BigQuery ? ドキュメントは公式(特に【概念】がおすすめ) クラウド屋さんのドキュメントも読んでいいかも
ただQiita含めた軽めの記事は、古いと使えないものが多い Qwiklabsですら、画面仕様とか古いままだったりする 読むより、使え
Copyright © 2018 Cavity.LLC All Rights Reserved. データウェアハウス? • データの倉庫で、何らかの判断や分析材料として利用が主目的
• SAP/Oracleなどが代表格で、専門のSEが運用することも多い • データマイニングツールと呼ばれる分析ツールの利用 • データマートと呼ばれる利用目的別のDBを作るケースも多い (顧客情報(CRM) + 自社売上管理DB など)
Copyright © 2018 Cavity.LLC All Rights Reserved. データウェアハウス? • DBとの決定的な違いは
◦ トランザクションレベルでの性能は期待しない ◦ 更新しない(する場合は追加、もしくはコピーで再度マート化 ◦ 削除なし(する場合はデータセットもろとも削除
データ解析系のGCPサービス • Cloud Storage • Bigtable • Spanner • Cloud
Pub/Sub • Cloud ML Engine • Google Drive • Google Marketing Platform • Google Ads • Youtube • BigQuery • Dataflow • Dataproc • Dataprep • Datastudio • Google Spread sheet
Copyright © 2018 Cavity.LLC All Rights Reserved. Easy try&error. Cannot
break. This is Happy.
パイプライン例 1 複数の仮想マシンログの集約
サーバからコマンドログを収集 Architecture: Script log > BigQuery : Direct stored into
BigQuery Preprocessing Cloud Dataprep Query BiqQuery Analyze Datastudio Data producer Compute Engine Others source Virtual Machine Others source Virtual Machine Others source Virtual Machine Survey logger Python script Unstructured Spreadsheet
パイプライン例 2 データパイプラインのミニマム構成
Data source Cloud Storage Webサイトの表をBBQしてみる Architecture: Unstructured Data > Dataprep
and BiqQuery with Datastudio - BBQ Preprocessing Cloud Dataprep Query BiqQuery Analyze Datastudio csv / tsv Google Sheets Unstructured Spreadsheet
https://github.com/wakayama-pref-org
データリフト おまけの話
データリフト 社内や倉庫眠る紙媒体の業務データを全てクラウドへリフト →ダークデータのクラウドリフト 売上伝票 日報 クレーム 対応結果 仕入伝票 Cavity
Scan Scanner Payment log Dark Data Data source Cloud Storage
ダークデータのリフト Architecture: Unstructured Data > Cloud Storage and BiqQuery - DataLift Query BiqQuery Analyze Datastudio csv / tsv Google Sheets Excel/csv/tsv Excel Receipt Dark Data behavior Dark Data human log Dark Data
Let’s BBQ with us !
Thank you !