Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コス...
Search
satoh-y-0323
July 14, 2026
Technology
1.3k
3
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コスト最適化
Claude Code で動くマルチエージェントの個人OSS C3
タスクごとにどのモデルを使うか自体を学習させる というアプローチ
satoh-y-0323
July 14, 2026
More Decks by satoh-y-0323
See All by satoh-y-0323
Issue の起票者に、 聞いてはいけない質問がある タスク自走ハーネスの“質問の宛先”設計
satohy0323
3
730
Other Decks in Technology
See All in Technology
修正PRを食べてレビュースキルが賢くなる:Claude Codeによる自己改善サイクル
yuyaumetsu
4
1.1k
AIエージェントを前提としたプラットフォーム エンジニアリング:GKEで作るAgent-Ready Golden Path
legalontechnologies
PRO
1
150
変化の早いClaude Codeを 書籍に落とし込む
oikon48
6
1.2k
【CEDEC2026】『GRANBLUE FANTASY: Relink - Endless Ragnarok』のバトル制作事例 ~最高のキャラゲーを目指して~
cygames
PRO
0
190
クラウドセキュリティ入門 ~安全なクラウド利用のための基礎知識~
lhazy
8
7.6k
[MIRU26] To What Extent Does MLLM-as-a-Judge Exhibit Cross-Model Preference Bias?
keio_smilab
PRO
0
200
ブラウザ研修 2026
recruitengineers
PRO
3
390
TypeScript入門 2026
recruitengineers
PRO
1
250
メルカリのグローバルアプリで挑んだ AlloyDB 運用と課題解決の実践記
hatappi
0
230
【CEDEC2026】ゲームシナリオライターを支援するAIツール開発の実践 ― 設計とプロンプトの工夫 ―
cygames
PRO
1
710
PLaMo 3.0 Primeの構造化出力サポート
pfn
PRO
0
180
AI エージェント時代のデジタルアイデンティティ
fujie
3
1.4k
Featured
See All Featured
The Illustrated Guide to Node.js - THAT Conference 2024
reverentgeek
1
420
Effective software design: The role of men in debugging patriarchy in IT @ Voxxed Days AMS
baasie
0
460
Tell your own story through comics
letsgokoyo
1
1k
Design of three-dimensional binary manipulators for pick-and-place task avoiding obstacles (IECON2024)
konakalab
0
510
Visual Storytelling: How to be a Superhuman Communicator
reverentgeek
2
610
AI Search: Implications for SEO and How to Move Forward - #ShenzhenSEOConference
aleyda
1
1.3k
I Don’t Have Time: Getting Over the Fear to Launch Your Podcast
jcasabona
34
2.8k
The #1 spot is gone: here's how to win anyway
tamaranovitovic
3
1.1k
Sharpening the Axe: The Primacy of Toolmaking
bcantrill
46
2.9k
The Language of Interfaces
destraynor
162
27k
The AI Search Optimization Roadmap by Aleyda Solis
aleyda
1
6k
Exploring the relationship between traditional SERPs and Gen AI search
raygrieselhuber
PRO
2
4.2k
Transcript
タスクの複雑さでモデルを選ぶ Thompson Sampling で動かす“ トークン/ コスト最適化” @satoh_y_0323 / 個人OSS C3
(Claude Code Conductor)
モデル選び、結局“ 勘” になっていませんか 「簡単そうだから安いモデルでいいか」は 毎回人間が判断 判断基準が 言語化されていない ので引き継げない 「本当にそのモデルで精度は足りていたか」は 検証されないまま
トークン節約術 Night - TECH BATON - 2
C3 の tier-routing :3 段階で“ 選ぶ理由” を作る 複雑度を推定 ▶ Thompson
Sampling で学習 ▶ 拮抗時は安い方(cost-aware ) 人の勘ではなく、過去の承認/ 否認の実績でモデルを選ぶ トークン節約術 Night - TECH BATON - 3
実際に溜まったデータ(自分のOSS 開発ログ) c3 tier stats で複雑度×Tier 別に 成功率・トークン・実コスト が見える ※個人開発ログの実測値(収集期30
試行を卒業済み・履歴には failure もそのまま残る) トークン節約術 Night - TECH BATON - 4
推奨止まり→ 適用したら、次の問題が見えた これまで 「実行時に変更不可」 と 思い込み 推奨を表示するだけ → 誰も従わない ➜
検証→ 即実装 呼び出し時の明示指定 で 切り替え可能と判明 その日に適用まで実装 → 推奨が実際に効く ➜ 適用で見えた罠 安いモデルが一度失敗 すると二度と選ばれな い デッドロックが発覚 → 失敗の定義を再設計 トークン節約術 Night - TECH BATON - 5
持ち帰り(ツールが何でも真似できる) モデル選びは 言語化して検証できる状態 にする 「簡単/ 複雑」の判定と「選んだ結果」を 両方記録する(記録は消さず、集計ル ールだけ変える) 失敗に数えるのは 客観的な事象だけ(テスト不合格・スタック)
拮抗したら 安い方を選ぶ、というルールだけでも十分効く 最適化は 適用して初めて次の問題が見える ── 測る→ 適用→ また測る トークン節約術 Night - TECH BATON - 6
今日のひとこと モデル選びを“ 勘” から、 “ 実データに基づく学習” に。 C3 ─ pip
install claude-code-conductor / @satoh_y_0323 / つまずき報告がいちばんあ りがたいです 7