Upgrade to Pro — share decks privately, control downloads, hide ads and more …

【re:Invent 2024 アプデ】 Prompt Routing の紹介

Champ
December 17, 2024

【re:Invent 2024 アプデ】 Prompt Routing の紹介

Champ

December 17, 2024
Tweet

More Decks by Champ

Other Decks in Technology

Transcript

  1. 1. (Intelligent)Prompt Routing とは 新機能の概要 re:invent 2024 で発表された新機能(プレビュー) プロンプトの複雑さを自動判定し、最適なモデルへ自動 振り分け

    2024/12/17 時点では以下のルーティングが可能 Claude Sonnet 3.5 と Claude 3 Haiku Llama 3.1 70B と Llama 3.1 8B なにが嬉しいのか? プロンプトを適切なモデルにルーティングすることでコ ストを下げることが可能
  2. 2. 仕組み ルーティングの実施 quality_difference と 閾値(responseQualityDifference) を比較 quality_difference が 閾値未満の場合、軽量モデルを選択

    閾値以上の場合、高性能モデルを選択 2024/12/17 時点ではデフォルト値は 0.0 になっている? ので、差が少しでもあれば Sonnet を選択
  3. 2. 仕組み ルーティングの実装 続き 簡略化したルーティングロジックのイメージ quality_difference = high_quality_model_score - lightweight_model_score

    responseQualityDifference = 0.1 # 閾値が 0.1 の場合 if quality_difference < responseQualityDifference: # 品質差が小さい場合(0.1未満) # → 軽量モデル(Haiku)を使用 # → "この程度の質問なら軽量モデルで十分"というケース use_lightweight_model() else: # 品質差が大きい場合(0.1以上) # → 高性能モデル(Sonnet)を使用 # → "この質問は高性能モデルを使う価値がある"というケース use_high_quality_model()