Upgrade to Pro — share decks privately, control downloads, hide ads and more …

(登壇資料)アウトカムより先に"AI活用定着"を 〜量・質・コストで"組織平均"を底上げする〜

Avatar for 菅本隆文 菅本隆文
September 03, 2026
10

(登壇資料)アウトカムより先に"AI活用定着"を 〜量・質・コストで"組織平均"を底上げする〜

Avatar for 菅本隆文

菅本隆文

September 03, 2026

Transcript

  1. アウトカムより先に、"組織平均の底上げ" を測って伸ばす 成果は⼀部のトップではなく組織平均で。アウトカム接続はその後。 ▲ 定着を測りきってから よくある失敗 STEP 2 事業アウトカムへの接続 (売上‧リードタイム

    等) ✗ トッププレイヤーが⽬⽴つ。組織で底上 げすべき層の定着‧活⽤レベルを⾼く⾒積も る ✗ 定着前にアウトカムへ急ぐ STEP 1 AI活⽤の組織定着 (組織平均の底上げ) 順序を逆にすると、習熟途上のメンバーが萎縮して活⽤が縮む。⼀度縮めると広げ直しは⾼くつく。だから "定着が先"。 © Findy Inc. 4
  2. (⾊んな意⾒があると思いますが) 量‧質‧コストをモニタリング+そのKPI的重要指標として"Skills活⽤量" を⾒る ※ポイント:すべて組織‧チーム平均の推移で追う。平均が揃って改善していれば効率的な定着。 量 質 コスト トークン消費量 / AI⽣成PR数

    マージ率 / レビューコメント数 / 変更障害率 AI作成PRあたりコスト どれだけ使えているか‧作れているか AIが⽣成するPRの質は担保されているか 極端に上がりすぎていないか 重要指標 Skills活⽤量 — 量‧質‧コストすべてを貫くドライバー AI時代の新指標 ① PRあたりコスト ② ⾃⾛率(= CLI作業時間 ÷ ユーザーCLI操作アクティブ時間。⾒れると⾯⽩い) © Findy Inc. 5
  3. 各指標を実際どう計測するか(詳細は懇親会で) 取得元は⼤きく2つ。GitHub 由来と、Claude Code の OpenTelemetry 由来。 対象指標 GitHub 由来

    OTel 由来 AI⽣成PR数(PRラベル / commit trailer で識別)‧マージ率‧レビュー コメント数‧変更障害率 取得元 対象指標 取得元 トークン量‧ AI⽣成PR数‧PRあたりコスト‧Skills活⽤量‧⾃⾛率 OpenTelemetry GitHub API / MCP 踏み込むと⻑いので、もっと詳しく知りたい⽅はぜひ懇親会で捕まえてください 🍻 © Findy Inc. 6
  4. なぜ Skills が重要指標なのか? (弊社データ)Skills は 量‧質‧コスト すべての先⾏ドライバー。 量 全体‧どのチームでも、Skills利⽤量と AI⽣成PR数が⼀定以上の相関を⽰す

    質 レビュー時の指摘を⾃動学習させられる。⼈を教育するより効率が⾼い コスト ステップ指定で無駄な⼊⼒トークンを削減。精度向上でラリーも減りコスト減 Skill実⾏回数(棒)と AI⽣成PR数(線)が連動して⽴ち上がる(4‒7⽉‧全社) © Findy Inc. 6
  5. 実データ紹介:同⼀7名での⽐較(⼀⼈当たり / ⽉) ⼈数変動を排した公正な⽐較。アウトプット⼤幅増、かつコストは半減。 指標 4‒5⽉ 6‒7⽉ 変化 Skill実⾏回数(平均) 約149回

    約357回 ×2.4 AI作成PR数(平均) 19.9本 97.9本 ×4.9 コスト / PR(平均) $49.7 $24.5 半分以下 マージ率(平均) 95.4% 94.1% ほぼ横ばい ⼈のレビューコメント数(合計) 84件 74件 -11% 同じ7名で⽐べても、Skill実⾏↑に伴い PR数は平均‧中央値とも⼤幅増、コストは半減。 © Findy Inc. 7
  6. どんな Skills 利⽤が増えたのか?(開発プロセス上流から下流まで) トップダウンで整備したpluginを中⼼に上流から下流まで各⼯程のSkillsで増加 ⼯程(上流→下流) 主なスキル 4‒5⽉ 6‒7⽉ 変化 ①

    要件定義 verify-requirements 203 351 ×1.7‧⼀本化 ② Issue分解‧実装 exec-github-issue + parent-issue 80 296 ×3.7(親Issue分解 新登場) ③ テスト設計 test-strategy-guide 147 229 ×1.6‧⼀本化 ④ 実装規約(FE) react-guide(fc-frontend-plugin) 54 159 ×2.9 ⑤ PR作成 pull-request 168 318 ×1.9 ⑥ セルフレビュー self-reviewer(プラグイン版+単体版) 264 452 ×1.7‧⼀本化 ⑦ コードレビュー codex-reviewer / code-review 189 590 ×3.1(code-review新登場) ⑧ 指摘対応〜クローズ検証 reply-review-comments / verify-close-issue ほか ‒ 809 新登場:下流へ拡張 集約 並存 → プラグイン版に⼀本化(標準ワークフローに収斂)。 拡張 指摘対応〜クローズ検証が新登場で「実装→PR」から下流⼯程までカバー。 ※ 対象:同⼀7名。期間はほぼ同⼀⻑(61⽇ vs 60⽇)。数値は画⾯表⽰の上位スキルのみの集計。「⼀本化」は単体版が6‒7⽉の上位から消えたことに基づく(下位での少量利⽤はあり得る)。 © Findy Inc. ‒