Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
【re:Invent 2024 アプデ】 Prompt Routing の紹介
Search
Champ
December 17, 2024
Technology
560
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
【re:Invent 2024 アプデ】 Prompt Routing の紹介
Champ
December 17, 2024
More Decks by Champ
See All by Champ
MCPサーバー、AWSのどこに置く?
champ
0
120
Kiro CLI 徹底解剖
champ
0
31
Amazon Bedrockの自動推論チェックを検証!
champ
0
21
Amazon BedrockでClaude 3.5 Sonnet v2のComputer useを試す
champ
0
130
【Bedrock×Athena】生成系AIでSlackデータの分析に挑戦
champ
0
240
Amazon Qの全体像を掴んでみよう!
champ
0
87
神アプデ?Amazon Comprehendで 生成系AIの毒性検出に挑戦!
champ
0
390
Bedrockで挑戦! 生成系AIで Slackコミュニケーションの活性化!
champ
0
470
Other Decks in Technology
See All in Technology
デジタル・デザイン:次の50年を描く「進化する青写真」
y150saya
0
150
Fabricをフル活用する AI Agent Hub -製造業特化AIエージェントの設計
iotcomjpadmin
0
160
AI Agentをシステムに組み込む前にゆるく向き合ってみる
hayama17
0
170
Text-to-SQLをAgentCoreで実現し、生成されるSQLの精度を定量的に評価する
yakumo
2
140
從觀望到全公司落地:AI Agentic Coding 導入實戰 — 流程整合與安全治理
appleboy
0
170
技術・能力を向上する原理原則 #きのこセッションa #きのこ2026
bash0c7
0
170
5分でわかる Amazon Connect_20260608
hwangbyeonghun
0
140
“詰む”前に仕組みを作れ 〜技術の波に溺れないためのキャッチアップ術〜
takasyou
7
4.4k
5分でわかるDuckDB Quack
chanyou0311
4
270
時期が悪い!それでもRaspberry Piを買って遊んで活用するには / 20260627-osc26do-rpi-jikigawarui
akkiesoft
1
910
40代で“やっとエンジニアになれた”――閉じた学びを開き、空の青さを知る / 20260628 Naoki Takahashi
shift_evolve
PRO
4
1.2k
「軸足」は 固定しなくていい - 熱量と強みで描く、しなやかなキャリアの形
kakehashi
PRO
1
290
Featured
See All Featured
Writing Fast Ruby
sferik
630
63k
How to Grow Your eCommerce with AI & Automation
katarinadahlin
PRO
1
210
A brief & incomplete history of UX Design for the World Wide Web: 1989–2019
jct
2
400
The Art of Programming - Codeland 2020
erikaheidi
57
14k
Building Experiences: Design Systems, User Experience, and Full Site Editing
marktimemedia
0
540
Primal Persuasion: How to Engage the Brain for Learning That Lasts
tmiket
0
380
How to Think Like a Performance Engineer
csswizardry
28
2.7k
JAMstack: Web Apps at Ludicrous Speed - All Things Open 2022
reverentgeek
1
480
The Impact of AI in SEO - AI Overviews June 2024 Edition
aleyda
5
1.1k
HDC tutorial
michielstock
2
720
The Hidden Cost of Media on the Web [PixelPalooza 2025]
tammyeverts
2
340
The Curious Case for Waylosing
cassininazir
1
410
Transcript
【re:Invent 2024 アプデ】 Prompt Routing の紹介
自己紹介
1. (Intelligent)Prompt Routing とは 新機能の概要 re:invent 2024 で発表された新機能(プレビュー) プロンプトの複雑さを自動判定し、最適なモデルへ自動 振り分け
2024/12/17 時点では以下のルーティングが可能 Claude Sonnet 3.5 と Claude 3 Haiku Llama 3.1 70B と Llama 3.1 8B なにが嬉しいのか? プロンプトを適切なモデルにルーティングすることでコ ストを下げることが可能
2. 仕組み 処理の流れ Prompt Routing は以下の流れで処理が行われます プロンプト受信 パフォーマンスの計算 ルーティングの実施 実行とフォールバック
それぞれについて解説していきます
2. 仕組み プロンプト受信 Prompt Routing がプロンプトを受け取る プロンプトの特徴を分析(長さ、複雑さ、要求タスクなど)
2. 仕組み パフォーマンスの計算 設定された各モデル(例:Sonnet と Haiku)でのパフォーマンスを計算 推論は実行せず、パフォーマンスの計算のみを実施 モデル間の品質差(quality_difference)を算出
2. 仕組み ルーティングの実施 quality_difference と 閾値(responseQualityDifference) を比較 quality_difference が 閾値未満の場合、軽量モデルを選択
閾値以上の場合、高性能モデルを選択 2024/12/17 時点ではデフォルト値は 0.0 になっている? ので、差が少しでもあれば Sonnet を選択
2. 仕組み ルーティングの実装 続き 簡略化したルーティングロジックのイメージ quality_difference = high_quality_model_score - lightweight_model_score
responseQualityDifference = 0.1 # 閾値が 0.1 の場合 if quality_difference < responseQualityDifference: # 品質差が小さい場合(0.1未満) # → 軽量モデル(Haiku)を使用 # → "この程度の質問なら軽量モデルで十分"というケース use_lightweight_model() else: # 品質差が大きい場合(0.1以上) # → 高性能モデル(Sonnet)を使用 # → "この質問は高性能モデルを使う価値がある"というケース use_high_quality_model()
2. 仕組み 実行とフォールバック ルーティングで選択されたモデル(Sonnet or Haiku)で推論を行う ルーティング失敗時やタイムアウト時は、フォールバックモデル(Sonnet)を使 用して推論
3. 実際に試してみる 3 つのテストケースを用意: 1. シンプルな質問 2. 中程度の質問 3. 複雑な質問
テストケース 1: こんにちは 「こんにちは」
テストケース 1: こんにちは 「こんにちは」 → Sonnet が選択される
テストケース 2: EC2 について質問 「AWS の EC2 とは何ですか?一行で説明してください」
テストケース 2: EC2 について質問 「AWS の EC2 とは何ですか?一行で説明してください」 → Sonnet
が選択される
テストケース 3: 英語で質問 What is your name?
テストケース 3: 英語で質問 What is your name? → Haiku が選択される
テストケース 4: 英語で EC2 について質問 What is EC2?
テストケース 4: 英語で EC2 について質問 What is EC2? → Haiku
が選択される
考察 日本語で質問した場合、それだけでスコアが上がっている可能性がある そのため、閾値の調整が必要 英語の質問は適切にルーティングされてそう
5. まとめ Prompt Routing のメリット 1. 簡単にプロンプトの内容に応じたモデルを動的に使用できる 2. 適切なモデルを選ぶことによってコストの削減・応答時間の改善が期待できる 実装時の注意点
日本語の場合は閾値の調整が必要 プレビュー中なので閾値の調整はできない?
ご清聴ありがとうございました!