Upgrade to Pro — share decks privately, control downloads, hide ads and more …

Amazon Nova understanding models に触れてみた

Sponsored · Your Podcast. Everywhere. Effortlessly. Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
Avatar for kojikojisan kojikojisan
January 24, 2025
16

Amazon Nova understanding models に触れてみた

Avatar for kojikojisan

kojikojisan

January 24, 2025

Transcript

  1. 5 以前より噂されていたコードネーム「Olympus(オリンパス)」と呼ばれるLLM その謎を解明すべく、我々はアマゾンの奥地へ向かった ―― “AWS re:Invent 2024” で突如として現れた、Amazon独自開発LLMの 「Amazon Nova」

    普段、Anthropic 社の “Claude” を使用している我々は、 「Claude と何が違うのか」「プロダクトに組み込める性能なのか」謎は深まるばかり 今まで存在しているAmazon独自LLM「Titan」とはもう忘れ去られてしまうのか
  2. Creative Content Generation models 画像モデル(Image-to-image) • Amazon Nova Canvas 動画モデル(Text-to-video,

    Image-to-video) • Amazon Nova Reel 6 Amazon Nova とは Understanding Models 軽量モデル(Text only) • Amazon Nova Micro 汎用モデル(Text, Image, Video-to-text) • Amazon Nova Lite • Amazon Nova Pro • Amazon Nova Premier (coming soon...) What’s Next for Amazon Nova? 音声モデル(Speech-to-Speech) マルチモデル(Any-to-Any)
  3. 7 Amazon Nova understanding models ◆軽量モデル(Text only) Amazon Nova Micro

    高速レスポンス要件 etc. 最大トークン: 128K ✓ 1,000 Input token 0.000035 USD ✓ 1,000 Output token 0.00014 USD ◆汎用モデル(Text, Image, Video-to-text) Amazon Nova Lite Amazon Nova Pro 基本的なQA、解析 etc. 最大トークン: 300K 最大画像サイズ: 25MB ✓ 1,000 Input token 0.00006 USD ✓ 1,000 Output token 0.00024 USD 高度な推論分析 etc. 最大トークン: 300K 最大画像サイズ: 25MB ✓ 1,000 Input token 0.0008 USD ✓ 1,000 Output token 0.0032 USD
  4. 9 Amazon Nova 料金比較 Providers models 1,000 Input token (USD)

    1,000 Output token (USD) Amazon Amazon Nova Micro 0.000035 0.00014 Amazon Amazon Nova Lite 0.00006 0.00024 Anthropic Claude 3 Haiku 0.00025 0.00125 Amazon Amazon Nova Pro 0.0008 0.0032 Anthropic Claude 3.5 Haiku 0.0008 0.004 Anthropic Claude 3.5 Sonnet 0.003 0.015
  5. 10

  6. 11 Amazon Bedrock Chat/Text playground (1/2) AWSマネージドコンソール上で、LLMのお試し比較ができる機能 温度 • 多様性やランダム性を制御(値が高い:ランダム、値が低い:確実性を重視)

    トップP • トークンに対するサンプリング範囲(上位n%)を制御 (値が広い:ランダム、値が狭い:確実性を重視) トップK • トークンに対するサンプリング範囲(上位n個)を制御 (値が広い:ランダム、値が狭い:確実性を重視)
  7. 12 Amazon Bedrock Chat/Text playground (2/2) models Input tokens Output

    tokens Latency (ms) 1 token / ms Amazon Nova Micro 79 876 5,303 6.05 Claude 3 Haiku 113 990 8,183 8.26 Amazon Nova Lite 79 875 7,604 8.69 Claude 3.5 Haiku 113 656 12,968 19.76 Amazon Nova Pro 79 981 15,890 16.19 Claude 3.5 Sonnet 113 1,157 29,402 25.41