Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
家族アルバム みてねにおけるGrafana活用術 / Grafana Meetup Japan...
Search
Isao Shimizu
April 24, 2024
Technology
2
1.9k
家族アルバム みてねにおけるGrafana活用術 / Grafana Meetup Japan Vol.1 LT
2024.4.24
Grafana Meetup Japan #1 LT
Isao Shimizu
April 24, 2024
Tweet
Share
More Decks by Isao Shimizu
See All by Isao Shimizu
Notion x ポストモーテムで広げる組織の学び / Notion x Postmortem
isaoshimizu
1
320
New Relicを活用したSREの最初のステップ / NRUG OKINAWA VOL.3
isaoshimizu
3
1.1k
「家族アルバム みてね」における運用管理・ オブザーバビリティの全貌 / Overview of Operation Management and Observability in FamilyAlbum
isaoshimizu
5
3.3k
約10年間MIXIのインフラを 支えてきたPagerDutyの活用事例 / PagerDuty on Tour 2024
isaoshimizu
6
1.3k
家族アルバム みてねで直面してきた技術的負債 / MIXI KAG 2024
isaoshimizu
18
9.1k
今年1年のEKS運用振り返り/3-shake SRE Tech Talk
isaoshimizu
2
420
ポストモーテムの基礎知識と最新事例 / Fundamentals of Postmortem
isaoshimizu
12
3.3k
全世界1,800万人が利用する「家族アルバム みてね」におけるNew Relic活用法 / FutureStack Tokyo 2023
isaoshimizu
1
610
『家族アルバム みてね』で計測しているSLIの事例 / SLI as measured in FamilyAlbum
isaoshimizu
4
820
Other Decks in Technology
See All in Technology
AIエージェントに必要なのはデータではなく文脈だった/ai-agent-context-graph-mybest
jonnojun
1
250
SREが向き合う大規模リアーキテクチャ 〜信頼性とアジリティの両立〜
zepprix
0
480
量子クラウドサービスの裏側 〜Deep Dive into OQTOPUS〜
oqtopus
0
150
Amazon Bedrock Knowledge Basesチャンキング解説!
aoinoguchi
0
160
マーケットプレイス版Oracle WebCenter Content For OCI
oracle4engineer
PRO
5
1.6k
pool.ntp.orgに ⾃宅サーバーで 参加してみたら...
tanyorg
0
900
ファインディの横断SREがTakumi byGMOと取り組む、セキュリティと開発スピードの両立
rvirus0817
1
1.6k
私たち準委任PdEは2つのプロダクトに挑戦する ~ソフトウェア、開発支援という”二重”のプロダクトエンジニアリングの実践~ / 20260212 Naoki Takahashi
shift_evolve
PRO
2
210
プロダクト成長を支える開発基盤とスケールに伴う課題
yuu26
4
1.4k
Greatest Disaster Hits in Web Performance
guaca
0
290
生成AIを活用した音声文字起こしシステムの2つの構築パターンについて
miu_crescent
PRO
3
220
Frontier Agents (Kiro autonomous agent / AWS Security Agent / AWS DevOps Agent) の紹介
msysh
3
190
Featured
See All Featured
AI: The stuff that nobody shows you
jnunemaker
PRO
2
270
Principles of Awesome APIs and How to Build Them.
keavy
128
17k
Max Prin - Stacking Signals: How International SEO Comes Together (And Falls Apart)
techseoconnect
PRO
0
88
The Director’s Chair: Orchestrating AI for Truly Effective Learning
tmiket
1
99
So, you think you're a good person
axbom
PRO
2
1.9k
JavaScript: Past, Present, and Future - NDC Porto 2020
reverentgeek
52
5.8k
Stop Working from a Prison Cell
hatefulcrawdad
273
21k
The Web Performance Landscape in 2024 [PerfNow 2024]
tammyeverts
12
1k
Accessibility Awareness
sabderemane
0
57
コードの90%をAIが書く世界で何が待っているのか / What awaits us in a world where 90% of the code is written by AI
rkaga
60
42k
実際に使うSQLの書き方 徹底解説 / pgcon21j-tutorial
soudai
PRO
196
71k
Imperfection Machines: The Place of Print at Facebook
scottboms
269
14k
Transcript
©MIXI ©MIXI 家族アルバム みてねにおける Grafana活用術 Grafana Meetup Japan #1 LT
Vantageスタジオ みてねプロダクト開発部 プラットフォームグループ 清水 勲
2 ©MIXI About me 週末は社会人吹奏楽団での活動(楽団長、トロンボーン約30年、たまに指揮者) キャンプとクラフトビールが好き New Relic User Group
運営 清水 勲 @isaoshimizu 家族アルバム みてね Engineering Manager(SRE/CRE/セキュリティ) SIer時代(受託・自社開発) SNS「mixi」 モンスター ストライクなど みてね 2003年 2011年 2014年 2018年 2024年 新卒入社 ミクシィ(現MIXI)入社 C/C++/C#/PHP/Python/iOS/AWS Fedora/MySQL/LXC /OpenStack Linux/MySQL/Ruby AWS/MySQL/Ruby 2022年1月〜EM
©MIXI 家族アルバム みてね
©MIXI 家族アルバム みてねはスマホで撮った子どもの写真や動画を家族と共有し、 コミュニケーションして楽しむ家族アルバムサービスです。
©MIXI 家族アルバム みてねでは 直近6年くらい Grafana が大活躍しています!
©MIXI 家族アルバム みてねにおける オブザーバビリティの変遷
7 ©MIXI 家族アルバム みてねにおけるオブザーバビリティの変遷 Amazon CloudWatch コンソール サービスリリース SREチーム設立 New
Relic APM Grafana New Relic Infrastructure 現在 Prometheus 2015年 2018年 2024年 EKS移行 完了 2021年 以降はGrafanaのデータソースとしての利用が多い New Relic Mobile
8 ©MIXI 家族アルバム みてねにおけるオブザーバビリティの全体像 Amazon EKS Kubernetes Prometheus New Relic
Rails New Relic Ruby agent Grafana Node Exporter Amazon CloudWatch Amazon Managed Service for Prometheus Grafana Loki Promtail ユーザーの端末上 のアプリ New Relic Mobile モニタリング環境 Fluent Bit Amazon Data Firehose Amazon S3 Amazon Athena GCS BigQuery ETL処理 データの流れ Amazon Aurora Amazon RDS Performance Insights
©MIXI なぜ Grafana?
10 ©MIXI なぜ Grafana? 圧倒的な使い勝手の良さ • 画面遷移、操作が軽い、グラフ描画が速い • グラフが美しい、種類が豊富 •
マネジメントコンソールの認証を通らなくて良い(別の認証を使える) • 様々なデータソースを扱える(CloudWatch以外にもGoogle、Prometheus、Loki、Tempoなど) • Persistent URL / Shortened URL での共有が楽(Slackでのコミュニケーションなど) • アップデートが簡単(Helm Chartのバージョン上げるだけ。マイグレーション簡単) • SSO対応(アカウント棚卸し簡単) • オートリフレッシュ • アノテーション(グラフにコメントできる) • Explore機能(Prometheusのクエリをサクッと試すとか)
©MIXI Grafana 活用シーン
12 ©MIXI Grafana 活用シーン • 毎日の朝会でダッシュボードをチーム全員で眺める(SREチーム、Data Engineeringチームなど) ◦ 各グラフのトレンドの変化を見る ▪
例:AWSコスト、LBリクエスト数とエラー数、Aurora/DynamoDB/ElastiCacheの負荷、 SES/SNSの送信数とエラー数、ジョブキューの滞留状態、ノード数、Pod数、OOMKilled等 • アラート発報時 ◦ New Relicも併用しつつ、Grafanaのダッシュボードを見て、アラート内容から関連箇所のグラフ を確認する • ログ確認 ◦ Lokiを介して開発環境、本番環境のログを見る • 施策ごとのダッシュボード ◦ 規模の大きめな施策時に個別のダッシュボードを作り、施策に関わるメトリクスをモニタリングで きるように
©MIXI Grafana のおかげで 数々の問題を解決してきました
©MIXI Grafana 大好きです!
©MIXI