Upgrade to Pro — share decks privately, control downloads, hide ads and more …

現代AIエージェント理論202606

 現代AIエージェント理論202606

次の文字を当てるプログラムでしかないLLMから始まって仕事を実行できる現代のAIエージェントに至るまでの道のりをたどる。
資料を使ってAIエージェントがどのような要素から成り立っているのかを知ることで利用上の注意や限界を知るきっかけとなることを目指した。
2026年06月時点の情報で作成

Avatar for tomfook

tomfook

July 15, 2026

More Decks by tomfook

Other Decks in Technology

Transcript

  1. 1 言葉を予測する機械 LLM 賢そうに見えても、やっていることの核は「次に来る単語を当てる」 入力された文の続きを予測する LM(言語モデル)とは 今日の天気は ____ テキストの確率分布を学んだ統計モデル。『この文脈 なら次はこの語が来やすい』を膨大な文章から学習す

    る。 晴れ 78% 雨 54% 曇り 41% 大規模化したのが LLM 最高 12% 同じ仕組みを Deep Learning で規模を拡大。さらにイン ターネットに公開されている大量のデータを使って学 習させた 確率がいちばん高い語を選び、それを入力に足して、また次を予 測 —— これを繰り返すだけ。 ⇒公開知識は持つが非公開情報や学習後の出来事は知 らない
  2. 2 人間に仕える機械への改造 InstructGPT 続きを書くだけの機械を指示に従う機械に仕立て直す 問題:続きを予測するだけでは役に立たない 「富士山の高さは?」→ 「富士山の高さは? 琵琶湖の面積は?利根川の長さは?...」 アラインメント(方向づけ) InstructGPT

    HHH アラインメント SFT 人間が書いた“良い応答”例を学ばせ、対話の型を仕込む 報酬モデル + RLHF 人間の好みを点数化し最適化 「富士山の高さは?」→「3,776 メートルで、日本一高い山です」 問いに答える AI を「もっともらしい続き」から「人間にとって望ましい方向」へ 目標: Helpful 役に立つ(指示に従う) Honest 正直(事実に忠実) Harmless 無害(危険・有害な出力を避ける) 副作用 人間の好みに最適化した結果 (a)おべっか/同調(sycophancy):ユーザーに気に入られる答えへ寄せる (b)幻覚(hallucination):自信のない答えは好まれないので知らないことも堂々とそれらしく言い切る。
  3. 3 指示から会話へ ChatModel 往復してやりとりできるようにする 1 2 補完モデル 3 instruct モデル

    chat モデル 続きを書く 指示に答える。単発 会話の履歴を踏まえ何往復もできる。 素の LLM SFT+RLHF ChatML でロールを構造化 ChatML:会話を“役割”で構造化する system user assistant 実装 前提・ルールを与える(最優先) 入力 「あなたは丁寧な案内係です。」 「富士山の高さは?」 <|im_start|>system あなたは丁寧な案内係です。<|im_end|> <|im_start|>user 富士山の高さは?<|im_end|> <|im_start|>assistant AI の応答 出力 「3,776 メートルです。」 3,776メートルです。<|im_end|> ユーザーの発言
  4. 4 自分で考える CoT/Reasoning 即答せず途中の思考を展開してから結論を出す 具体例:同じ問いでも結果が変わる 問: ある数を 3 倍して 7

    を足し、2 で割ると 20。元の数は? 即答:「9」 一足飛びに出して外す。 順を追う: 2 で割ると 20 → 割る前は 40 7 を足して 40 → 足す前は 33 3 倍して 33 → 元の数は 11 ✓ アップデート Reasoningにより陳腐化したプロンプト 「ステップ・バイ・ステップで考えて」 「あなたは一流のコンサルタントです」 過去に有効とされたプロンプトの一部は性能を悪化させる より重要になったのはメッセージの構造化 文脈の提供 前提・制約を明示的に渡す モデルは学習してないこと書いてないことは知らない。 社内の背景、期間、対象範囲、使うデータの定義を選んで与える。 成果物の条件 何ができたら終わりか これをプロンプトで実行させるのがCoT モデル学習時点で能力を持たせるのがReasoning model 出力形式、満たすべき要素、やってほしくない事を定義して与える 曖昧だとそれらしい結果が得られる。
  5. 5 手足を持つ機械 Tool Use 文字を出力する存在からプログラムを実行する存在へ 構造:システムが LLM を“呼ぶ” 道具を“選ぶ判断”を LLM

    に委ねる システム × 人が指定:「この関数を使え」→ ただの自動化 Read(読取) Write(書込) Web Search Bash(実行) API 呼出 DB 照会 LLM ◎ LLM が判断:状況を見て「ここは検索」「ここは実行」 と自分で決める。この自律性が便利さと暴走リスクの両方 の源。 判断を任せる部品 1〜4まで 5 モデルそのものの進歩 モデルを部品にしたシステム 予測 → 対話化 → 推論。LLM 単体が賢くなる話。 LLM はもう完成品ではなく“一部品”。それを組み込んだプロ グラムの発明。
  6. Tool の分類学 読む・書く・動かす・委ねる Retrieve 取得・検索 Write 変更 Read / Grep

    / Web Search Write / Update / Delete システム内部や外部から情報を読み取る ファイルを作成し、編集する コード出力がパワフル Execute 実行 Delegate 委譲・協調 Bash / API 呼出 AskUser / call Subagent 外部のプログラムやサービスを動かす。最も強力で最も危険。 MCPの多くはここ 人や別エージェントに委ねる。 ヒューマン・イン・ザ・ループ/マルチエージェント
  7. CORE DIAGRAM AI エージェント = Agentic Loop 目的を達成するまで「思考 → 選択

    → 実行 → 結果取得」を自分で回し続ける 起動 プログラムがループを回す 達成 → 出力 思考 前周の結果を解釈し次を考 える ユーザーの プロンプト ツール結果取得 出力を受け取り次周へ積む プログラム処理 目的達成 まで反復 ツール実行 アプリが道具を動かす 達成と判定したら抜ける LLM が判断 ツール選択 どの道具を使うか決める ユーザーへの 回答
  8. 6 ここまでの時間軸 数年で「予測する機械」から「自律する機械」へ。積み上げの順番が大事。 2020 2023-24 2025-26 LLM の大規模化 Tool Use

    AI エージェント GPT-3。次単語予測を桁違いの 規模へ 道具を呼べる手足を獲得 Agentic Loop で自律実行 2022 2024-25 InstructGPT / ChatGPT Reasoning モデル 対話化。SFT+報酬モデルで“使 える”AI 思考を内在化、推論で精度向 上
  9. HOW SMART, REALLY? 最前線の頭脳はどこまで賢いのか かつての定番 MMLU(大学レベルの知識問題)は最前線モデルが 90% 超で“飽和”し、差がつかなくなった。 そこで知識では解けない、思考力を問う難問ベンチが登場した。 Humanity's

    Last Exam (HLE) FrontierMath “人類最後の試験”。100超の分野の専門家が作問 研究級の数学。著名数学者が監修・作問 問題の例: 「ハチドリだけが持つ特殊な種子骨は何対の腱を支えているか?」 「ギリシャ神話の英雄イアソンの母方の曽祖父は誰か?」 「詩篇104:7の本文について「閉音節」をすべて挙げよ やたら難しい大学院レベルの数学問題 難しさの格: 1問に専門の数学者でも数時間〜数日。問題文は引用しない(理解できない) • 数学者が既存に存在しない新規問題を作成。本番問題は非公開 • 知識だけでは解けない • 人類が持つ知識の広さ、深さ+推論(専門の研究者レベル) • 見たことのない問題を解くことができるかを評価する • MMLU (大学レベル)が飽和した後の後継として誕生。 到達の“軌跡” 登場時 ほぼ 0% 1年強で 急上昇 最前線モデルでも数%しか解けなかった 桁違いのペースで伸び続けている 人間専門家に匹敵するレベルに到達
  10. 7 使い手側も、関わり方が変わってきた 「うまく頼む」から「環境を整える」へ —— 力点が移動している 2022–2024 2025 2026 プロンプト エンジニアリング

    コンテキスト エンジニアリング ハーネス エンジニアリング 聞き方を工夫してモデルから良い答 えを引き出す。指示文の技術 モデルに何を読ませて何を読ませな いかを設計し、必要で十分な情報を 与えることで最高の応答を引き出す モデルを安全に長時間動かす装具を 設計
  11. CUTTING EDGE ハーネス・エンジニアリング Agent = Model + Harness Model +

    Harness(装具) ツール・オーケストレー ション コンテキスト & 記憶 ガードレール どの道具をどの順で呼ぶか、結果をどう次 に渡すかの制御する。 限られた窓に何を載せ、何を外部記憶へ退 避するか。 暴走・逸脱・誤操作を止める枠。承認ステ ップや権限制御。 e.g. Agent Skill e.g. Memory e.g. Hook 関心の移動:「モデルをどう賢くするか」より「賢いモデルをどれだけ長く自律稼働させ、間違えないよう制御できるか」へ