Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
家族アルバム みてねにおけるGrafana活用術 / Grafana Meetup Japan Vol.1 LT
Search
Isao Shimizu
April 24, 2024
Technology
1
1k
家族アルバム みてねにおけるGrafana活用術 / Grafana Meetup Japan Vol.1 LT
2024.4.24
Grafana Meetup Japan #1 LT
Isao Shimizu
April 24, 2024
Tweet
Share
More Decks by Isao Shimizu
See All by Isao Shimizu
家族アルバム みてねで直面してきた技術的負債 / MIXI KAG 2024
isaoshimizu
18
8.3k
今年1年のEKS運用振り返り/3-shake SRE Tech Talk
isaoshimizu
2
200
ポストモーテムの基礎知識と最新事例 / Fundamentals of Postmortem
isaoshimizu
11
2.1k
全世界1,800万人が利用する「家族アルバム みてね」におけるNew Relic活用法 / FutureStack Tokyo 2023
isaoshimizu
1
310
『家族アルバム みてね』で計測しているSLIの事例 / SLI as measured in FamilyAlbum
isaoshimizu
3
640
4年間の取り組みで実現したコンテナ技術を活用したスケーラブルなインフラ構築とコスト削減 / Container Summit 2023
isaoshimizu
1
150
全世界のユーザー体験の改善にNew Relic Mobileをどのように活用したか/How New Relic Mobile was used to improve the global user experience
isaoshimizu
2
700
オブザーバビリティの始め方 / How to start Observability
isaoshimizu
4
950
全世界で成長し続けるサービスのインフラと開発の裏側 / MIXI TECH CONFERENCE 2023
isaoshimizu
1
1.4k
Other Decks in Technology
See All in Technology
コードや知識を組み込む / Incorporate Code and knowledge
ks91
PRO
0
150
Rustで「プリズモイダル法」を利用して「土量計算」をガチでやる
nokonoko1203
1
300
Building a RAG-poweredAI chat appwith Python and VS Code
pamelafox
0
160
アクセス制御にまつわる改善 / Improving access control
itkq
0
590
MixIT 2024 - Pulumi : Gérer son infra avec son langage de programmation préféré
ju_hnny5
1
120
[新卒向け研修資料] テスト文字列に「うんこ」と入れるな(2024年版)
infiniteloop_inc
5
18k
AWS学習者向けにAzureの解説スライドを作成した話
handy
3
190
VSCodeの拡張機能を作っている話
ebarakazuhiro
1
800
自己改善からチームを動かす! 「セルフエンジニアリングマネージャー」のすゝめ
shoota
6
1k
The AI Revolution Will Not Be Monopolized: Behind the scenes
inesmontani
PRO
1
160
BPStudyの200回を中心にIT業界を振り返る。そしてこれから
haru860
3
400
Cypress or Playwright?
rainerhahnekamp
0
170
Featured
See All Featured
Building Better People: How to give real-time feedback that sticks.
wjessup
356
18k
Large-scale JavaScript Application Architecture
addyosmani
504
110k
Refactoring Trust on Your Teams (GOTO; Chicago 2020)
rmw
26
2.3k
How To Stay Up To Date on Web Technology
chriscoyier
782
250k
No one is an island. Learnings from fostering a developers community.
thoeni
16
2.1k
Code Review Best Practice
trishagee
56
15k
jQuery: Nuts, Bolts and Bling
dougneiner
59
7.2k
CSS Pre-Processors: Stylus, Less & Sass
bermonpainter
352
28k
It's Worth the Effort
3n
180
27k
[Rails World 2023 - Day 1 Closing Keynote] - The Magic of Rails
eileencodes
8
1.3k
WebSockets: Embracing the real-time Web
robhawkes
59
7k
Let's Do A Bunch of Simple Stuff to Make Websites Faster
chriscoyier
501
140k
Transcript
©MIXI ©MIXI 家族アルバム みてねにおける Grafana活用術 Grafana Meetup Japan #1 LT
Vantageスタジオ みてねプロダクト開発部 プラットフォームグループ 清水 勲
2 ©MIXI About me 週末は社会人吹奏楽団での活動(楽団長、トロンボーン約30年、たまに指揮者) キャンプとクラフトビールが好き New Relic User Group
運営 清水 勲 @isaoshimizu 家族アルバム みてね Engineering Manager(SRE/CRE/セキュリティ) SIer時代(受託・自社開発) SNS「mixi」 モンスター ストライクなど みてね 2003年 2011年 2014年 2018年 2024年 新卒入社 ミクシィ(現MIXI)入社 C/C++/C#/PHP/Python/iOS/AWS Fedora/MySQL/LXC /OpenStack Linux/MySQL/Ruby AWS/MySQL/Ruby 2022年1月〜EM
©MIXI 家族アルバム みてね
©MIXI 家族アルバム みてねはスマホで撮った子どもの写真や動画を家族と共有し、 コミュニケーションして楽しむ家族アルバムサービスです。
©MIXI 家族アルバム みてねでは 直近6年くらい Grafana が大活躍しています!
©MIXI 家族アルバム みてねにおける オブザーバビリティの変遷
7 ©MIXI 家族アルバム みてねにおけるオブザーバビリティの変遷 Amazon CloudWatch コンソール サービスリリース SREチーム設立 New
Relic APM Grafana New Relic Infrastructure 現在 Prometheus 2015年 2018年 2024年 EKS移行 完了 2021年 以降はGrafanaのデータソースとしての利用が多い New Relic Mobile
8 ©MIXI 家族アルバム みてねにおけるオブザーバビリティの全体像 Amazon EKS Kubernetes Prometheus New Relic
Rails New Relic Ruby agent Grafana Node Exporter Amazon CloudWatch Amazon Managed Service for Prometheus Grafana Loki Promtail ユーザーの端末上 のアプリ New Relic Mobile モニタリング環境 Fluent Bit Amazon Data Firehose Amazon S3 Amazon Athena GCS BigQuery ETL処理 データの流れ Amazon Aurora Amazon RDS Performance Insights
©MIXI なぜ Grafana?
10 ©MIXI なぜ Grafana? 圧倒的な使い勝手の良さ • 画面遷移、操作が軽い、グラフ描画が速い • グラフが美しい、種類が豊富 •
マネジメントコンソールの認証を通らなくて良い(別の認証を使える) • 様々なデータソースを扱える(CloudWatch以外にもGoogle、Prometheus、Loki、Tempoなど) • Persistent URL / Shortened URL での共有が楽(Slackでのコミュニケーションなど) • アップデートが簡単(Helm Chartのバージョン上げるだけ。マイグレーション簡単) • SSO対応(アカウント棚卸し簡単) • オートリフレッシュ • アノテーション(グラフにコメントできる) • Explore機能(Prometheusのクエリをサクッと試すとか)
©MIXI Grafana 活用シーン
12 ©MIXI Grafana 活用シーン • 毎日の朝会でダッシュボードをチーム全員で眺める(SREチーム、Data Engineeringチームなど) ◦ 各グラフのトレンドの変化を見る ▪
例:AWSコスト、LBリクエスト数とエラー数、Aurora/DynamoDB/ElastiCacheの負荷、 SES/SNSの送信数とエラー数、ジョブキューの滞留状態、ノード数、Pod数、OOMKilled等 • アラート発報時 ◦ New Relicも併用しつつ、Grafanaのダッシュボードを見て、アラート内容から関連箇所のグラフ を確認する • ログ確認 ◦ Lokiを介して開発環境、本番環境のログを見る • 施策ごとのダッシュボード ◦ 規模の大きめな施策時に個別のダッシュボードを作り、施策に関わるメトリクスをモニタリングで きるように
©MIXI Grafana のおかげで 数々の問題を解決してきました
©MIXI Grafana 大好きです!
©MIXI