Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
週末にAI-DLCを本気で回したら$1,600溶けた
Search
Sponsored
·
SiteGround - Reliable hosting with speed, security, and support you can count on.
→
Atsushi Shimizu
August 27, 2026
Programming
100
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
週末にAI-DLCを本気で回したら$1,600溶けた
Atsushi Shimizu
August 27, 2026
Other Decks in Programming
See All in Programming
Press start. Python's next generation.
willingc
PRO
3
300
AIと壁打ちしながら進めるコスト管理
fufuhu
2
1.9k
Jindong: Introducing Declarative Haptics in Compose Multiplatform
l2hyunwoo
0
140
AI Readyの正体はデータマネジメントだ メダリオン2.0の最前線
freee
PRO
0
500
FastAPI の並行処理モデルを完全に理解する
hoto17296
9
3.3k
ALB ログから Trace を気合で繋げる技術
fohte
7
840
tsc.rip を支える技術 / Kyoto.なんか #8
susisu
0
4.1k
Webエンジニアなのにブラウザの仕組みがわからないので、Pythonで自作してみた
tatsuki12
4
1.6k
AIを上手に使っていこうとしたら越境せざるを得なくなった話 〜実践1年で見えた境界を越えなければならない理由と進め方〜 / Crossing borders with AI
tomoyakitaura
2
900
進化を続けるGo toolsの現在地 / The Current State of Ever-Evolving Go Tools
hond0413
0
280
typoなんかねぇよ
raspython3
0
630
GKE アップグレード前に知っておきたい Blue/Green と PDB の関係
stkk
0
120
Featured
See All Featured
How Software Deployment tools have changed in the past 20 years
geshan
1
34k
Self-Hosted WebAssembly Runtime for Runtime-Neutral Checkpoint/Restore in Edge–Cloud Continuum
chikuwait
0
760
Large-scale JavaScript Application Architecture
addyosmani
515
110k
Amusing Abliteration
ianozsvald
1
280
Crafting Experiences
bethany
1
270
Side Projects
sachag
455
43k
The SEO identity crisis: Don't let AI make you average
varn
0
550
Sharpening the Axe: The Primacy of Toolmaking
bcantrill
46
3k
Reflections from 52 weeks, 52 projects
jeffersonlam
356
21k
実際に使うSQLの書き方 徹底解説 / pgcon21j-tutorial
soudai
PRO
201
75k
The SEO Collaboration Effect
kristinabergwall1
1
540
How to build a perfect <img>
jonoalderson
1
5.9k
Transcript
A I - D LC v 1 P R A
C T I C E R E P O R T 週末にAI-DLCを 本気で回したら $1,600溶けた 速さだけでは測れない、AIチームの生産性 2026/8/27 株式会社HBA 清水厚志 @shimizuxa
国内事例で語られるのは「速さ」 日立産業制御ソリューションズ様 東京海上日動システムズ様 約530人時 → 約70人時 2〜3か月 → 1.5日 7名・2日間でプロトタイプを構築
10名で周辺Webシステムの初期版を構築 ※対象・参加人数・完成条件は事例ごとに異なる 出典1: https://aws.amazon.com/jp/blogs/news/ai-dlc-unicorn-gym-hitachi-ics-202601/ 出典2: https://aws.amazon.com/jp/blogs/news/tokio-marine-ai-dlc/ 2
「圧倒的な速さ」は見つかる でも、AI利用料は? 私が調べた範囲では、具体額まで公開した国内事例は見つけにくかった 3
1行プロンプトから始めた話ではない 100 + 1 万行+ 複数 要求・設計・知識文書 整理済みMarkdown 外部システム境界 複雑なPoC:
未合意契約・状態・冪等性・複数Agent・品質証跡 4
週末の結果 約66 時間 4 Unit $1,607 相当 開始から中断まで 実装+品質証跡 160,734
AI Credits換算 workspace全体で1,000件超のテストケースがPASS 注意: 利用量のドル換算であり、実際の追加請求額とは限らない 5
でも、$1,600で 話は終わらなかった LT申込後もAI-DLCを継続 → 費用はその後も増加 6
止まらなければ、課金も止まらない 従量計測 超過利用 → Copilot CLIも → 組織・Enterpriseは AI Credits対象
既定で利用可能 予算上限 → 機能あり/今回は未設定 今回の要因: 予算上限を設定せず、超過利用可能な構成で継続した 7
費用の山は、実装後半の品質ループ 80.9 % 61.4 % 74.7 % 最初の週末 背景Agent 最初の週末
入力200K token超 継続セッション review中心区間 AI Credits構成比。※最初の週末の2指標は分類軸が異なり、重複を含む 高かった処理: 品質を「作る・確かめる・説明する」ための再読と反復 8
ある真面目すぎるAIプロジェクトチーム Manager AI M AI語 R 「closureは0件に」 Planner AI P
AI語 「進行Gateにも」 人間語 「最後は指摘ゼロに」 人間語 「開始前の必須条件にも」 Reviewer AI 修正担当AI AI語 「固定roundはstale」 人間語 「前回の合格はもう古い」 F AI語 「Minorも全部修正」 人間語 「小さな指摘も全部直す」 当時の私: この会話で「止まる条件」が厳しくなったと気づけなかった 9
品質目標が「ローカル規程」になった日 AI語は読める でも、これがルール変更? 進⾏ルール M 「closureは0件に」 closure = 0 /
0 / 0 Blocking / Major / Minor の指摘件数 ? Manager AI 実⾏前 Gate にも適⽤ P Planner AI 「進⾏Gateにも」 開始前の必須条件へ⼀般化 最新 review = 0 / 0 / 0 変更のたびに合格を取り直す R Reviewer AI 「固定roundはstale」 監督役:⼈間 AI-DLC指⽰でもユーザー指⽰でもなく、AI⽣成のローカルpolicyとして整備されてしまった 10
全員が正しく働くほど、仕事が増える Reviewer AI 指摘を⾒つける RELEASE / ROLLBACK PLAN 独⽴監査AI 最初から読む
修正担当AI 1.3K → 6.8K lines review × 15 まだ 全部直す 「品質向上中」 だと思っていた… Planner AI 計画を更新する 11
そして、ファイルを1枚移動した 1 質問ファイルを移動 Q&A 2 鮮度確認が反応 3 巨⼤計画を再レビュー inventory 55
→ 56 PLAN PASS 6.8K⾏ 1 file 正しい⽂書領域 変更は、たった1ファイル 0/0/0 直前の合格が失効 Re-review 14:1 / 2 / 0 ⼈間がようやく STOP 12
AI語を「ルール変更」として読めなかった AIチーム 監督役 品質目標を忠実に守る AI-DLC初挑戦の私 品質目標をローカル規程化 会話の意味はおおむね読めた 小変更でも全量レビュー でも、進行ルールの変更と見抜けなかった 従量課金に予算上限なし
優秀なAIチームを率いるには、 AI語を習得するしかない? 13
AI語を覚えるより「境界」を先に決める 1 Review boundary 差分+関連契約へ絞る 2 Test boundary 変更影響で回帰testを選ぶ 4
Model / Cost boundary 難易度・usage・budgetで分業 5 Plan / Stop boundary 複雑度とreview回数に上限 3 Context boundary 有効な意思決定だけを配る 仕組みで監督: 全会話を追わず、境界を超えたら人間判断へ戻す 14
5つの境界を実装し、使い始めた R Review 有望 差分review+安全fallback T Test 変更影響+targeted test 方式見直し
routing規約+usage/budget計測 P Plan / Stop 有望 C Context M Model / Cost 有望 complexity check+review回数上限 採用見直し decision manifest+context packet 初期観測: 3施策は有望 / Contextは採用見直し / Model-Costは方式見直し 15
品質確認は減らさない 境界が明確 未知・曖昧・情報が古い・高リスク 必要な範囲へ絞る 全量に戻す 差分レビュー・影響テスト・必要な文脈に 全量レビュー・全回帰・人間判断へ戻す 絞る 現在地: 施策は選別中
/ 全量へ戻す安全策は維持 16
QCDで測るAI-DLCの生産性 Q Quality:品質 何を守れたか 今回の焦点 C Cost:AI利用料 いくら使ったか D Delivery:開発期間
何人月 → 何日 最初に目が行くのはD。 今回はCから「止め方」を学んだ 17
今回のキーメッセージ 予算と停止線は、 人間が決め、仕組みで守る AIチームに仕事を渡しても、境界を決める責任は渡さない
T H R E E-W E E K P OST
M O RT E M 週末に 3週間、 AI-DLCを本気で回したら $1,600 $X,XXX 溶けた 予算と停止線は、人間が決め、仕組みで守る Thank you @shimizuxa