Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
リアルタイムデータ分析基盤をKafka(Strimzi) & Druidで構築し
Search
Kenta Kozuka
June 30, 2021
Programming
130
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
リアルタイムデータ分析基盤をKafka(Strimzi) & Druidで構築し
Kenta Kozuka
June 30, 2021
More Decks by Kenta Kozuka
See All by Kenta Kozuka
フィーチャーフラグ&ABテストツールBucketeer開発の経緯 〜社内基盤としてのプロダクト戦略〜
kentakozuka
0
240
事業部を超えた 開発生産性向上に挑戦する
kentakozuka
7
1.7k
1000人を超えるエンジニア組織へのGitHub Copilot導入促進
kentakozuka
0
390
KubeCon 2023 China Recap & ブースを出展してきました
kentakozuka
0
310
PipeCD Good First Issues
kentakozuka
0
66
サイバーエージェントでCDツールを内製した話
kentakozuka
1
570
PipeCDでGitOpsやってみよう!
kentakozuka
0
1k
サイバーエージェントのフィーチャーフラグを活用した高速開発
kentakozuka
0
68
フィーチャーフラグを使用した開発で 迅速かつ安全にリリースする
kentakozuka
0
91
Other Decks in Programming
See All in Programming
標準パッケージに uuid が追加された 背景から見る Go らしい意思決定 / go_127_uuid_decision
convto
2
1.4k
高専、大学編入、そして未踏へ〜プロダクト開発とキャリアの歩み - Technical College, University Transfer, and On to “Mitou” / My Journey in Product Development and Career
pkmiya
0
140
数年滞っていたダークモード対応をおよそ2週間で完了させる
chigichan24
0
680
Gmail/Google DriveをトリガーにAIエージェントを動かそう! / Run AI agents with Gmail/Google Drive as triggers!
har1101
3
470
The Good Stuff, Not the Slop: Engineering High-Quality Android Apps with Modern AI Tooling
danybony
1
190
スマート反転とウェブアクセシビリティ
camiha
0
140
LL言語やWebフレームワークのPostgreSQL対応 〜DBの機能がユーザーに届くまで〜
kentaroutakeda
0
140
AI駆動開発にグラフDBを重ねてみた
satoshi256kbyte
2
750
XP祭りでしか伝わらないフリップネタ #xpjug
murabayashi
0
110
初心者DevRelとして参加者だった私が、DevRel Talks!#2に登壇するまでにしてきたこと
sokohirai
0
340
『寄り添うラジオ』をAIで作る 体験価値から逆算した、会話しないUXと品質設計
theoriatec2024
3
130
PyO3 で既存 Python 評価器を Rust core 化する ー wasm-bindgen でブラウザにも配るための設計
kdash
1
500
Featured
See All Featured
WCS-LA-2024
lcolladotor
0
820
Keith and Marios Guide to Fast Websites
keithpitt
413
23k
Design in an AI World
tapps
1
310
Leveraging Curiosity to Care for An Aging Population
cassininazir
1
490
BBQ
matthewcrist
89
10k
Conquering PDFs: document understanding beyond plain text
inesmontani
PRO
4
3k
Side Projects
sachag
455
43k
Building Better People: How to give real-time feedback that sticks.
wjessup
370
20k
Being A Developer After 40
akosma
91
590k
Making the Leap to Tech Lead
cromwellryan
135
10k
Thoughts on Productivity
jonyablonski
76
5.4k
The Spectacular Lies of Maps
axbom
PRO
1
980
Transcript
リアルタイムデータ分析基盤を Kafka(Strimzi) & Druidで構築した @kentakozuka
@kentakozuka @CyberAgent - Backend - Go, Python - 今やっていること →
In-House Feature Flag & A/B Testing Platform 「Bucketeer」という名前です 社内プロダクト用フィーチャーフラグ &
ABテストプラットフォーム 複数のプロダクトで導入 今回はGKE上に構築しているデータ分 析パイプラインの話
コスト高 データ量: 5TB/week BigQuery Druid & Kafka コスト削減 GKEのノード分のコスト
Druid 大規模データ分析 - 列指向 - 大量のインサート - リアルタイム分析 - 並列処理
- 統計量 スケーラブル インテグレーション - 分散型DB - Self-healing - Self-balancing - Kafka - Kenesis - S3 - GCS - HDFS Airbnb, Alibaba, Expedia, Lyft, Netflix, Optimizely, Twitter, Yahoo などで導入実績 https://druid.apache.org/druid-powered - 公式Operatorあり - GitOps - ちょっと使いづらい On Kubernetes
But, Pub/Sub未対応… - PRあるけど進んでない
Strimzi Kafka Operator - Kafka is now Kubernetes-Native - GitOps
- シンプルで使いやすい - Zookeeper, Exporterも全部やってくれる - ヘルスチェック、ログ、メトリクス
After
所感 & まとめ 導入はそれなりに大変だけど、メリットはある Druid - 分析基盤として性能・機能共にフィットするプロダクトは多そう - チューニングが難しい -
Pub/Sub対応してほしい - 開発が活発なGo SDKがほしい Strimzi - シンプルで使いやすい Kubernetes上に構築するときOperatorがあると安心する
Thank you!