Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コス...
Search
satoh-y-0323
July 14, 2026
Technology
1.3k
3
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コスト最適化
Claude Code で動くマルチエージェントの個人OSS C3
タスクごとにどのモデルを使うか自体を学習させる というアプローチ
satoh-y-0323
July 14, 2026
More Decks by satoh-y-0323
See All by satoh-y-0323
Issue の起票者に、 聞いてはいけない質問がある タスク自走ハーネスの“質問の宛先”設計
satohy0323
3
750
Other Decks in Technology
See All in Technology
【CEDEC2026】『ウマ娘 プリティーダービー』 英語版のキャラクターの方言や口調をローカライズするための創造的アプローチ
cygames
PRO
1
200
20260807_第6回_関東kaggler会LT_claw系bot xangiと始める、"寂しくない" kaggle
sugupoko
0
190
名古屋の市バスGTFS-JPデータ×スガキヤ 最寄りバス停検索をAmazon ElastiCache Serverless for Valkeyで最適化する
usanchuu
1
460
初めてのGitHub Actions / GitHub Actions at First
tooppoo
0
150
サイバー捜査員研修(後半)
nomizone
1
800
Digitization部 紹介資料
sansan33
PRO
2
7.7k
モバイルアプリ開発概論2026
recruitengineers
PRO
3
490
[しろおび夏祭り2026] チャットするAIから、作業するAIへ - 使われ方の変化と、その裏側で起きていること
kk0n
0
1.6k
AWS ネットワーク構築でハマった(ハマりかけた) 5選とそこから得た教訓
nagisa53
4
190
AIエージェントを前提としたプラットフォーム エンジニアリング:GKEで作るAgent-Ready Golden Path
legalontechnologies
PRO
2
210
認知負荷をGemini で溶かす — GKE 基盤「Orbit」における AI エージェントの実践
sansantech
PRO
1
270
【CEDEC2026】ゲームシナリオライターを支援するAIツール開発の実践 ― 設計とプロンプトの工夫 ―
cygames
PRO
1
770
Featured
See All Featured
Exploring the Power of Turbo Streams & Action Cable | RailsConf2023
kevinliebholz
37
6.5k
How to Talk to Developers About Accessibility
jct
2
490
Put a Button on it: Removing Barriers to Going Fast.
kastner
60
4.5k
職位にかかわらず全員がリーダーシップを発揮するチーム作り / Building a team where everyone can demonstrate leadership regardless of position
madoxten
64
56k
More Than Pixels: Becoming A User Experience Designer
marktimemedia
3
480
I Don’t Have Time: Getting Over the Fear to Launch Your Podcast
jcasabona
34
2.8k
Large-scale JavaScript Application Architecture
addyosmani
515
110k
Optimizing for Happiness
mojombo
378
71k
The Anti-SEO Checklist Checklist. Pubcon Cyber Week
ryanjones
0
200
The MySQL Ecosystem @ GitHub 2015
samlambert
251
13k
The Myth of the Modular Monolith - Day 2 Keynote - Rails World 2024
eileencodes
28
3.6k
Why You Should Never Use an ORM
jnunemaker
PRO
61
10k
Transcript
タスクの複雑さでモデルを選ぶ Thompson Sampling で動かす“ トークン/ コスト最適化” @satoh_y_0323 / 個人OSS C3
(Claude Code Conductor)
モデル選び、結局“ 勘” になっていませんか 「簡単そうだから安いモデルでいいか」は 毎回人間が判断 判断基準が 言語化されていない ので引き継げない 「本当にそのモデルで精度は足りていたか」は 検証されないまま
トークン節約術 Night - TECH BATON - 2
C3 の tier-routing :3 段階で“ 選ぶ理由” を作る 複雑度を推定 ▶ Thompson
Sampling で学習 ▶ 拮抗時は安い方(cost-aware ) 人の勘ではなく、過去の承認/ 否認の実績でモデルを選ぶ トークン節約術 Night - TECH BATON - 3
実際に溜まったデータ(自分のOSS 開発ログ) c3 tier stats で複雑度×Tier 別に 成功率・トークン・実コスト が見える ※個人開発ログの実測値(収集期30
試行を卒業済み・履歴には failure もそのまま残る) トークン節約術 Night - TECH BATON - 4
推奨止まり→ 適用したら、次の問題が見えた これまで 「実行時に変更不可」 と 思い込み 推奨を表示するだけ → 誰も従わない ➜
検証→ 即実装 呼び出し時の明示指定 で 切り替え可能と判明 その日に適用まで実装 → 推奨が実際に効く ➜ 適用で見えた罠 安いモデルが一度失敗 すると二度と選ばれな い デッドロックが発覚 → 失敗の定義を再設計 トークン節約術 Night - TECH BATON - 5
持ち帰り(ツールが何でも真似できる) モデル選びは 言語化して検証できる状態 にする 「簡単/ 複雑」の判定と「選んだ結果」を 両方記録する(記録は消さず、集計ル ールだけ変える) 失敗に数えるのは 客観的な事象だけ(テスト不合格・スタック)
拮抗したら 安い方を選ぶ、というルールだけでも十分効く 最適化は 適用して初めて次の問題が見える ── 測る→ 適用→ また測る トークン節約術 Night - TECH BATON - 6
今日のひとこと モデル選びを“ 勘” から、 “ 実データに基づく学習” に。 C3 ─ pip
install claude-code-conductor / @satoh_y_0323 / つまずき報告がいちばんあ りがたいです 7