Upgrade to Pro — share decks privately, control downloads, hide ads and more …

オブザーバビリティを高める AI エージェント体験を考える / Designing AI A...

Sponsored · Your Podcast. Everywhere. Effortlessly. Share. Educate. Inspire. Entertain. You do you. We'll handle the rest. →

オブザーバビリティを高める AI エージェント体験を考える / Designing AI Agent Experiences That Enhance Observability

Avatar for Kento Kimura

Kento Kimura PRO

October 01, 2026

Resources

AI for Observability 〜SaaS各社が語る、AI機能の最前線〜

https://jaguer-o11y-sre.connpass.com/event/404129/

More Decks by Kento Kimura

Other Decks in Technology

Transcript

  1. オブザーバビリティ を高める AI エージェント 体験を考える 1st Oct, Jagu'e'r オブザーバビリティ分科会 #6

    『AI for Observability 〜SaaS各社が語る、 AI機能の最前線〜』 Speaker: Kento Kimura
  2. > who am i? self_intro: name: “Kento Kimura” age: 29

    company: “Datadog” role: sales_engineer communities: - name: “Jagu‘e’r” description: “Japan Google Cloud Usergroup for Enterprise” - name: “JDDUG” description: “Japan Datadog User Group” - name: “JAWS-UG” description: “Japan AWS User Group” conferences: - name: “GCTS” description: “Google Cloud Community Tech Surge” - name: “o11yconjp” description: “Observability Conference Tokyo”
  3. 話すひと • 所属: Technical Solutions / Sales Engineering • コミュニティ:

    Jagu'e'r 歴4.5年 昨年 Jagu'e'r Leader になりました 🐯 • 担当: パブリッククラウドのアーキテクト知識を活かした Datadog のプリセールス技術支援をしています 木村 健人 (Kento Kimura) Datadog Japan GK • 昨年の登壇:
  4. アジェンダ 今日話すこと 01 人間とオブザーバビリティ 02 AI エージェント体験の変化 03 「動き出す」 AI

    エージェント 04 「見抜く」 AI エージェント 05 「信頼できる」 AI エージェント 06 まとめ
  5. 01 人間とオブザーバビリティ オブザーバビリティの定義 オブザーバビリティ とは、つまり… システム 入力 出力 ? システムの

    内部状態 外部シグナル “ “ 外部シグナル からシステムの内部状態 を推測できる能力
  6. 06 まとめ 体験の良し悪しを決めるのは、 モデル < ハーネス + 評価 動き出す 見抜く

    信頼できる 起点と実行の形を選ぶ 層をつなぎ、道具を組み合わせ、組 織の前提を渡す 推論を見せ、権限を揃え、測り続け る
  7. 06 まとめ 開発 - 速さと安全性を両立するコード検証 AIが書いたコードをテスト付きで マージ可能な状態にし、テスト済み の修正をすぐに用意できる Preview ステージングから本番まで、

    各変更の期待される挙動を 継続的に検証 Preview 変更を段階的にロールアウトし、 実行時のシグナルが問題を示せば 即座に切り戻し 33
  8. 06 まとめ 運用 - 本番障害の特定と修復の高速化 Preview 本番環境の挙動を継続的に分析し、 重要なシグナルを浮かび上がらせる Preview 事前に定義したガードレールの

    範囲内で、修正・スクリプト・コー ド変更を自律的に実行 重要なシグナルを横断し、 数分で根本原因を特定 34
  9. 06 まとめ オブザーバビリティエージェントで明日からできること 01 02 03 LLM 呼び出しとツール呼び出 しを、すべてトレースする 実際の障害を、正解と当時の

    シグナルつきで残す 採点を 1 つの合格率にせず、 軸を分ける Datadog Agent Observability の Experiments とカスタム LLM-as-a-judge で始められる
  10. 06 まとめ 参考資料 01 02 03 04 05 06 07

    08 Introducing Bits Investigation, your AI on-call teammate Datadog Blog, 2025-12-02 https://www.datadoghq.com/blog/bits-ai-sre/ Meet the new Bits Investigation: Deeper reasoning, twice as fast Datadog Blog, 2026-03-05 https://www.datadoghq.com/blog/bits-ai-sre-deeper-reasoning/ How we built an AI SRE agent that investigates like a team of engineers Datadog Blog, 2026-01-12 https://www.datadoghq.com/blog/building-bits-ai-sre/ How we built a real-world evaluation platform for autonomous SRE agents at scale Datadog Engineering, 2026-04-07 https://www.datadoghq.com/blog/engineering/bits-ai-eval-platform/ Bits Investigation — Knowledge Sources Datadog Docs https://docs.datadoghq.com/bits_ai/bits_investigation/knowledge_sources/ MCP Server でのコード実行 Datadog Docs https://docs.datadoghq.com/ja/mcp_server/code_execution/ Custom LLM-as-a-judge evaluations Datadog Docs https://docs.datadoghq.com/llm_observability/evaluations/custom_llm_as_a_judge_evaluations Building Effective Agents Anthropic Engineering https://www.anthropic.com/engineering/building-effective-agents