Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
SREのエッセンスを運用・保守に無理矢理入れようとして失敗した話
Search
Sponsored
·
Ship Features Fearlessly
Turn features on and off without deploys. Used by thousands of Ruby developers.
→
土井淳
August 25, 2022
Technology
630
1
Share
SREのエッセンスを運用・保守に無理矢理入れようとして失敗した話
土井淳
August 25, 2022
Other Decks in Technology
See All in Technology
価格.comをAI駆動で全面刷新する ー 30年分の技術的負債を返し、次の30年の土台をつくる ー / AI Engineering Summit Tokyo 2026
tkyowa
38
40k
ポスター発表&デモと総括 / Poster Presentations & Demonstrations and Summary
ks91
PRO
0
190
Platform engineering for developers, architects & the rest of us (AI agents)
danielbryantuk
0
180
【5分でわかる】セーフィー エンジニア向け会社紹介
safie_recruit
0
50k
Strands Agents超入門
kintotechdev
1
160
AIを「創る」と「使う」の循環 — HRテックが実践するリアルなAI組織実装
taketo957
0
1.1k
Databricks における 生成AIガバナンスの実践
taka_aki
1
280
「嘘をつくテスト」の失敗例から学ぶ 良いテストコード #frontend_phpcon_do
asumikam
0
160
AI Engineering Summit Tokyo 2026 AIの前に、やることがある 〜医療データ企業の4フェーズ〜
dtaniwaki
0
1.4k
もりもり新機能を一挙紹介! AgentCoreに入門して、AWS上にAIエージェントを構築しよう
minorun365
PRO
6
720
Cloud Run のアップデート 触ってみる&紹介
gre212
0
300
最低限これだけ押さえれ大丈夫_Claude Enterprise/Team企業展開ガバナンス入門
tkikuchi
1
720
Featured
See All Featured
How People are Using Generative and Agentic AI to Supercharge Their Products, Projects, Services and Value Streams Today
helenjbeal
1
200
Impact Scores and Hybrid Strategies: The future of link building
tamaranovitovic
0
300
技術選定の審美眼(2025年版) / Understanding the Spiral of Technologies 2025 edition
twada
PRO
118
120k
How to train your dragon (web standard)
notwaldorf
97
6.7k
<Decoding/> the Language of Devs - We Love SEO 2024
nikkihalliwell
1
230
Bash Introduction
62gerente
615
210k
Evolving SEO for Evolving Search Engines
ryanjones
0
210
10 Git Anti Patterns You Should be Aware of
lemiorhan
PRO
659
62k
Designing Experiences People Love
moore
143
24k
From Legacy to Launchpad: Building Startup-Ready Communities
dugsong
0
220
Winning Ecommerce Organic Search in an AI Era - #searchnstuff2025
aleyda
1
2k
Faster Mobile Websites
deanohume
310
31k
Transcript
SREのエッセンスを運用・保 守に無理矢理入れようとして 失敗した話 株式会社mediba テクノロジーセンター 土井
自己紹介 土井 淳 (Jun Doi) 職業: 株式会社mediba テクノロジーセンター テクノロジー統合 UNIT
業務内容: SREチーム リーダー・インフラ開発・運用 メモ: AWS歴5年 GCP歴: 1年程度 好きなサービスはAWS LambdaとStep Functions Twitter: @zuuundayo 2 2
注意 本発表並びにスライドに記載されている内容はあくまで個人の見解・発表であり、 所属する会社の公式な見解・発表ではございません。 3
目次 1. 何を行ったのか 2. SLI/SLOを運用・保守に取り入れてみてど うだった? 3. SLI/SLOを導入するための教訓 4
1. 何を行ったのか 5
1. 何を行ったのか • 弊社のSRE組織の起源はインフラストラクチャー部 ◦ これからの時代はインフラだけでは喰っていけない ◦ インフラ以外にも領域を広げていこう ◦ 部名がSRE推進部に変更
6
1. 何を行ったのか • SREという名前になったが... ◦ 活動内容はインフラストラクチャー部のまま ▪ 運用・保守に我々の活動指標としてSLI/SLOを取り入れよう Service Level
Indicator (SLI) システムの状態・パフォーマンスを把握するための指標 Service Level Objective (SLO) SLIの目標値・範囲 ex.) レイテンシー, エラー率, スループット, 稼働率 ユーザから見た時にあるべきシステム状態の目標(こういう状態であるべき) SLOによって仕事の優先順位を判断することもあり得ます(修繕か改善か 7
1. 何を行ったのか • なぜSLI/SLOを導入するのか? ◦ 様々なサービスのシステムがあるため俯瞰して状況を見づらい ▪ ダッシュボードを作ることで確認しやすく ◦ ユーザファーストを実現する
▪ ユーザが体験している状況を把握し、改善につなげる ◦ インフラは縁の下の力持ちで存在感がない ▪ 存在感を出していくためにも 成果を目に見える形に 8
1. 何を行ったのか • 導入にあたって準備したこと ◦ 全社への説明会 ◦ メトリクスの収集機構 ◦ ダッシュボードの作成
▪ QuickSight+ Azure AD SSO ▪ だれでもログインして閲覧できる 9
1. 何を行ったのか • どのようなSLIを取得したのか ◦ 数多くのシステムがある ▪ 共通で取得できる指標を一 括で集める •
ざっくりとSLOを設定 • ユーザ視点 • 可用性 • 月間稼働率 • 月間エラー率 • 月間レイテンシ • システム視点寄り • 月間アラート数 • 月間平均修復時間(MTTR) 10
2. SLI/SLOを運用・保守に取り入れてみ てどうだった? 11
2. SLI/SLOを運用・保守に取り入れてみてどうだった? • レポート内容を毎月担当からチームに共有 ◦ 要因等を開発チームにフィードバック • 稼働率等は時系列で永続的に記録 12
• よかったこと👍 ◦ QuickSightの知見を得ることができた ◦ SLIを上手く集約して閲覧できるようにできた • よくなかったこと👎 ◦ SLIデータは取得できたが運用・保守にはあまり役立たなかった
▪ 共通で取得したデータからわかることが少ない ▪ システムの現状が如実に表されていない ◦ SLI/SLO を活用した運用のイメージが具体的ではなかった ▪ 数値が悪くなった場合にどのような対応を取るべきか具体的では なかった(原因と結びつきにくい値) 13 → 結果としてあまり利用されずに運用はストップ 2. SLI/SLOを運用・保守に取り入れてみてどうだった?
3. SLI/SLOを導入するための教訓 14
3. SLI/SLOを導入するための教訓 15 • 欲張るな! ◦ 複数プロダクトまとめてやるのは難しい ◦ プロダクトごとの事情を汲み取るべし •
CUJ(Critical User Jorney)を基に決めよう ◦ ユーザにとっての不利益 (= ビジネス機会損失)を検知できる指標 • 運用イメージを具体的に考えられる値にしよう ◦ この値がこうだったらこういう影響が出ているからこうするといった運用をイメージできる指標を探す ▪ 可観測性を重視した メトリクス取得し、観察することでシステム特性も分かる ▪ まあそれが難しいんですけどね...
宣伝 現在弊社では毎月mediba Tech Cafeというイベントを行ってます! mediba Tech Cafe #9 「medibaのエンジニア解体新書〜1日の過ごし方編〜」 •
開催日: 8月30日(火)12:00 ~ 13:00 • 場所: オンライン (Youtube Live) • Connpassにて募集中 ◦ https://mediba-tech-cafe.connpass.com/event/257634/ 16 エンジニアブログもやってます https://ceblog.mediba.jp/ 色んな仲間も募集中です〜 (複業としても・複業やってても OK) https://hrmos.co/pages/mediba/jobs (ご興味あればぜひ)
おわりに 現在、SLI/SLOを用いた運用に再チャレンジ中です。 また別の機会に得られた知見を共有しようと思ってます。 ご清聴ありがとうございました! 17