Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
リアルタイムデータ分析基盤をKafka(Strimzi) & Druidで構築し
Search
Kenta Kozuka
June 30, 2021
Programming
120
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
リアルタイムデータ分析基盤をKafka(Strimzi) & Druidで構築し
Kenta Kozuka
June 30, 2021
More Decks by Kenta Kozuka
See All by Kenta Kozuka
フィーチャーフラグ&ABテストツールBucketeer開発の経緯 〜社内基盤としてのプロダクト戦略〜
kentakozuka
0
240
事業部を超えた 開発生産性向上に挑戦する
kentakozuka
7
1.7k
1000人を超えるエンジニア組織へのGitHub Copilot導入促進
kentakozuka
0
390
KubeCon 2023 China Recap & ブースを出展してきました
kentakozuka
0
310
PipeCD Good First Issues
kentakozuka
0
64
サイバーエージェントでCDツールを内製した話
kentakozuka
1
560
PipeCDでGitOpsやってみよう!
kentakozuka
0
1k
サイバーエージェントのフィーチャーフラグを活用した高速開発
kentakozuka
0
68
フィーチャーフラグを使用した開発で 迅速かつ安全にリリースする
kentakozuka
0
91
Other Decks in Programming
See All in Programming
属人化した知識を、 AIが辿れる地図にする
pkshadeck
PRO
1
200
複数の Claude Code が"放置"されてしまう問題をCLI ダッシュボードを自作して解決した話
sumihiro3
1
710
片田舎のおっさん、 Swift Buildのダイアモンド問題解決の不具合修正PRを出すが、解決方法がキャッシュをしないようにすることであり、ビルド時間が伸びると言われてマージされないので高速化もする/swiftbuild
yimajo
0
200
ソフトウェアエンジニアにとっての生成AI - 特性を知って使い倒す / generative ai for software enginner
kishida
7
2k
レビュー履歴をAIに食わせて、 Compose移行を加速するs
shihochan
0
160
S3 を使うアプリケーションをローカル完結で動かすことに全力を注いでみた / Running S3 Apps Offline
contour_gara
0
560
「つくるAI」だけではバグは見つからない ~テストに必要な「見つけるAI」を分離させる戦略~
mfunaki
0
120
KotlinConf Extended South Korea 2026 Keynote
l2hyunwoo
0
110
AWS DevOps AgentのAzure接続機能を検証して見えた活用法/Use Cases Verified for the AWS DevOps Agent's Azure Connectivity Feature
masakiokuda
1
250
今さら聞けない .NET CLI
htkym
0
200
VibeCodingからAgenticWorkflowへ
starfish719
0
700
Claude Code全社展開のためにやったことn選~プラグイン302個・コミッター271人を支えるために~
kenchan
5
1.6k
Featured
See All Featured
Creating an realtime collaboration tool: Agile Flush - .NET Oxford
marcduiker
35
2.5k
Git: the NoSQL Database
bkeepers
PRO
432
67k
Making the Leap to Tech Lead
cromwellryan
135
10k
How to Build an AI Search Optimization Roadmap - Criteria and Steps to Take #SEOIRL
aleyda
1
2.1k
Test your architecture with Archunit
thirion
2
2.3k
Practical Tips for Bootstrapping Information Extraction Pipelines
honnibal
25
2k
Faster Mobile Websites
deanohume
310
32k
Agile that works and the tools we love
rasmusluckow
331
22k
Making Projects Easy
brettharned
120
6.7k
AI Search: Implications for SEO and How to Move Forward - #ShenzhenSEOConference
aleyda
1
1.3k
Navigating Weather and Climate Data
rabernat
0
480
A brief & incomplete history of UX Design for the World Wide Web: 1989–2019
jct
2
480
Transcript
リアルタイムデータ分析基盤を Kafka(Strimzi) & Druidで構築した @kentakozuka
@kentakozuka @CyberAgent - Backend - Go, Python - 今やっていること →
In-House Feature Flag & A/B Testing Platform 「Bucketeer」という名前です 社内プロダクト用フィーチャーフラグ &
ABテストプラットフォーム 複数のプロダクトで導入 今回はGKE上に構築しているデータ分 析パイプラインの話
コスト高 データ量: 5TB/week BigQuery Druid & Kafka コスト削減 GKEのノード分のコスト
Druid 大規模データ分析 - 列指向 - 大量のインサート - リアルタイム分析 - 並列処理
- 統計量 スケーラブル インテグレーション - 分散型DB - Self-healing - Self-balancing - Kafka - Kenesis - S3 - GCS - HDFS Airbnb, Alibaba, Expedia, Lyft, Netflix, Optimizely, Twitter, Yahoo などで導入実績 https://druid.apache.org/druid-powered - 公式Operatorあり - GitOps - ちょっと使いづらい On Kubernetes
But, Pub/Sub未対応… - PRあるけど進んでない
Strimzi Kafka Operator - Kafka is now Kubernetes-Native - GitOps
- シンプルで使いやすい - Zookeeper, Exporterも全部やってくれる - ヘルスチェック、ログ、メトリクス
After
所感 & まとめ 導入はそれなりに大変だけど、メリットはある Druid - 分析基盤として性能・機能共にフィットするプロダクトは多そう - チューニングが難しい -
Pub/Sub対応してほしい - 開発が活発なGo SDKがほしい Strimzi - シンプルで使いやすい Kubernetes上に構築するときOperatorがあると安心する
Thank you!