Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
人間はどこまでさぼれるか? AIコーディングで人の関与を計測してみた
Search
Sponsored
·
SiteGround - Reliable hosting with speed, security, and support you can count on.
→
mattak
June 16, 2026
Programming
17
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
人間はどこまでさぼれるか? AIコーディングで人の関与を計測してみた
mattak
June 16, 2026
More Decks by mattak
See All by mattak
最近やった作業環境改善施策10個
mattak
0
320
UnixTime is Simple
mattak
0
280
おっさんが停滞しないために
mattak
32
19k
tech invest
mattak
1
390
Nodux - node base redux framework
mattak
0
1.6k
what_is_technical_investment
mattak
0
210
unitypackage distribution
mattak
0
900
Unity energy usage
mattak
0
1k
Unidux 0.3.1
mattak
1
450
Other Decks in Programming
See All in Programming
wkhtmltopdfの次どうするか問題2026
willnet
2
1.6k
Agents on Rails - Rails at Scale 2026
irinanazarova
0
200
Starting & Sustaining Code-Based E2E Testing for Non-Coding QA Teams( #jasstniigata )
teyamagu
PRO
1
500
モデルのリファクタリングが難しいと思ったら、そもそも複雑だったのはビジネス仕様だった ? / is-the-business-domain-the-real-complexity
hatsu38
0
390
[GoCon2026] When Goroutines Are Not Enough: Runtime Locality in High-Throughput Go
takehaya
6
2.4k
Intent as Code
shoppingjaws
6
1.1k
そのリトライ、死んだコネクションを使い回していませんか ── GoのHTTPクライアントとHTTP/2を実プロダクト障害から学び直す
myus4a
0
220
Security issues being discussed on Web Platforms
petamoriken
0
1.2k
thread_parallel_with_free-threaded_Python_and_NumPy.pdf
riku_sakamoto
0
360
Vue Fes Japan 2026 タイムテーブル徹底解説
448jp
1
510
手動確認はもう限界 〜XCUITestでCustom URL Schemeの遷移を起動種別ごとに自動テストする〜 / Testing Custom URL Schemes with XCUITest
otouto
0
330
AWS DevOps Agentで インシデント対応をAIに任せたい
honmarkhunt
7
3.1k
Featured
See All Featured
jQuery: Nuts, Bolts and Bling
dougneiner
66
8.6k
A designer walks into a library…
pauljervisheath
211
25k
Max Prin - Stacking Signals: How International SEO Comes Together (And Falls Apart)
techseoconnect
PRO
0
470
Building Applications with DynamoDB
mza
96
7.2k
How to build a perfect <img>
jonoalderson
1
6k
WENDY [Excerpt]
tessaabrams
14
39k
No one is an island. Learnings from fostering a developers community.
thoeni
21
3.8k
Lightning Talk: Beautiful Slides for Beginners
inesmontani
PRO
2
700
How STYLIGHT went responsive
nonsquared
100
6.3k
Done Done
chrislema
187
17k
A better future with KSS
kneath
240
18k
Test your architecture with Archunit
thirion
2
2.4k
Transcript
🍅 LT · A I コーディング実験 人間はどこまでサボれるか AIコーディングで「人の関与」を計測してみた 同じアプリを3つの応答スタイルで作り、人間の関与量を測る実験 2026.06
/ 開発お茶会 🍵 Lightning Talk
01 — きっかけ AIに任せても、結局ずっと「応答」している 🧑 この仕様でいい? 確認お願いします 🤖 ↻ えんえんと往復…
本当のボトルネックは、コードではなく 人間の関与(ヒューマンリソース)では? 問い 応答スタイルを変えると、 人間の関与はどれだけ減らせる?
02 — 実験の設計 同じお題を、3つの応答スタイルで ① 通常 素のAIに依頼 拡張なし。そのまま頼んで、逐次やり取り する。 ②
superpowers 仕様書 → 計画 → 実装 型を持つ拡張を使い、手順どおり進める。 ③ grill-me 先に質問攻め 仕様を徹底的に詰めてから実装に入る。 公平性の担保: 共通の1文プロンプト 隔離環境(メモリ/CLAUDE.md 不参照) 8項目テストで判定 ※ 4タイプ目(engineer-agent)は時間都合で未実施 → 3タイプ比較として提示
03 — お題選び なぜポモドーロタイマー? 🧱 ❌ テトリス(失敗) AIが1ターンで全部作ってしまい、差が出なかった。仕 様が一意に決まる題材は聞く必要がない。 🍅
⭕ ポモドーロ(採用) 記録の保存方法・残り時間の表示・入力UXなど正解が 一つに決まらない。だからAIが人間に確認したくなる。 分岐が多い題材ほど、関与の差が見えてくる
04 — スタートライン 全員、同じ1文から始めた $ electronを使って、ポモドーロタイマーをつくって。 要件はプロンプトに書かない。対話の中で引き出させる。完成は外形の振る舞いだけで YES/NO 判定。 受け入れテスト(8項目)
✓ 25分/5分でループできる ✓ 休憩時に全画面&最前面で残り時間表示 ✓ 途中で中止できる ✓ 残り時間がメニューバー等に表示される ✓ タイマーをキャンセルできる ✓ 開始時に「やること」を記述して開始 ✓ 休憩時に「やったこと」を記述できる ✓ その日の記録を見れる(時間・やること・やったこと)
05 — ものさし 関与を「量」と「質」で測る 量 発話ターン数 人間がAIに送ったメッセージの回数。やり取りそのもの の多さ。 質 意思決定回数(問答)
AIの質問・選択肢に人間が判断を下した回数。中身のあ る関与。 ※ 承認・却下・仕様追加・選択・方針提示は数える/「続けて」だけの促しは数えない
06 — 結果 関与量は ① < ② < ③ で大差。でも全部
8/8 達成 発話ターン 意思決定 ① 通常 ② superpowers ③ grill-me タイプ ターン 判断 作業時間 ① 通常 9 1 約45分 ② superpowers 13 5 約40分 ③ grill-me 28 25 約35分 受け入れ達成は 3タイプとも 8/8 完成度は同じ。違うのは関与量だけ。 9 1 13 5 28 25
07 — 成果物 同じ要件でも、こんなに形が違う ① 通常 素直なウィンドウアプリ 8/8 ② superpowers
タイマー窓+履歴窓 8/8 ③ grill-me メニューバー常駐+記録一覧 8/8
08 — 逆説のオチ 関与 少 → 速い? ❌ 一番たくさん関与した grill-me
が、 最短・最良だった ③ grill-me 28ターン/25判断でも、作業は最短35分・体感も一 番良い。 ① 通常 9ターンと最小でも、確認のイテレーションがダラダ ラ続いて非効率。 判断は "前倒し" が効く。後工程の手戻りが消える。
09 — 所感 3スタイルの「手触り」 😌 ① 通常 安心だけど非効率 逐次イテレーションで安心感はある。 が、毎回確認が挟まりHITL的にもたつ
く。 🤖 ② superpowers 丁寧だが驚きは少ない 仕様→計画→実装のフルセットで不備な し。型にはまる分、選ぶだけで楽。 🔥 ③ grill-me 濃いけど一番良い かなり細かく詰めてくる。気づかない論 点に気づける。面倒だが出来は最良。
10 — 持ち帰り 減らすより、"質とタイミング"を設計する お題の曖昧さ → 最適な応答スタイルは変わる 仕様が自明なお題 例:テトリス 素のAIに丸投げが最速 聞く必要がないなら、関与は最小でいい。
曖昧なお題 例:ポモドーロ 先に詰める(grill-me型) 前倒しの判断が、後工程の手戻りを救う。
11 — 正直なところ これは N=1 の観察です 01 各スタイル 1回ずつ の事例比較。統計ではない。
02 4タイプ目(engineer-agent)は未実施 → 今後の宿題。 03 「体感の良さ」は主観。意思決定カウントも線引きに幅がある。
12 — まとめ 関与は「減らす」より 「前倒しで設計する」 曖昧なお題ほど、先に判断を済ませるほうがトータルで速くて良い。 🚀 次にやりたいこと engineer-agent で「判断そのもの」を移譲できるか?
Coming soon ターンは減らせても、判断は移譲しきれるのか? ── が次の問い。