Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
PLaMoを毎日の開発で使い育てていく
Search
Preferred Networks
PRO
July 30, 2026
Technology
210
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
PLaMoを毎日の開発で使い育てていく
2026年7月30日に開催された「PFN LLMオープンハウス」での講演資料です。
Preferred Networks
PRO
July 30, 2026
More Decks by Preferred Networks
See All by Preferred Networks
User Namespaces in Production: Enabling Root in Containers with RWX
pfn
PRO
0
49
世界最先端の研究を製品へ~PFNでのプロダクトマネジメントの難しさとその醍醐味~
pfn
PRO
0
41
PLaMo 3.0 Primeの事後学習
pfn
PRO
0
310
PLaMo 3.0 Primeの構造化出力サポート
pfn
PRO
0
200
plamo-3-translateの開発
pfn
PRO
0
330
The Making of AI Chips
pfn
PRO
1
1.1k
国産生成AI PLaMoを支える事後学習と推論最適化
pfn
PRO
13
5.6k
Japanese SimpleQA: 日本語における事実に基づいた回答能力の評価ベンチマーク
pfn
PRO
1
460
Headlampと独自プラグインを活用したKubernetesダッシュボードの機能拡張
pfn
PRO
2
490
Other Decks in Technology
See All in Technology
LLM Internals: 언어 모델의 계보와 알고리즘 진화 (2023~2026)
inureyes
PRO
0
700
Bits Agent Builder の⼊⾨と活⽤事例
nulabinc
PRO
0
200
LanceDB入門
mocobeta
9
600
なぜ Temporal の大小比較には compare しかないのか / Why Does Temporal Only Have compare() for Comparisons
kazukihayase
1
160
自宅NWにISR4331を導入してみた話
okaits
0
110
Sansan Engineering Unit 紹介資料
sansan33
PRO
1
5k
修正PRを食べてレビュースキルが賢くなる:Claude Codeによる自己改善サイクル
yuyaumetsu
6
1.6k
My broken English still works: speaking at global OSS events
naruoga
0
110
猫付きpingコマンドを自作
uyuki234
0
260
【CEDEC2026】Creative Approaches to Localizing the Dialects and Unique Speech of Umamusume: Pretty Derby Characters in English
cygames
PRO
3
25k
AIコーディングの次。コードレビューと理解負荷を解消して組織の開発生産性を高める
moongift
PRO
2
2.7k
トヨタ⽣産⽅式(TPS)⼊⾨
recruitengineers
PRO
3
1k
Featured
See All Featured
Optimizing for Happiness
mojombo
378
71k
CoffeeScript is Beautiful & I Never Want to Write Plain JavaScript Again
sstephenson
162
16k
Primal Persuasion: How to Engage the Brain for Learning That Lasts
tmiket
0
420
Building Flexible Design Systems
yeseniaperezcruz
330
40k
Odyssey Design
rkendrick25
PRO
2
770
How to train your dragon (web standard)
notwaldorf
97
6.8k
Designing for Timeless Needs
cassininazir
1
450
Principles of Awesome APIs and How to Build Them.
keavy
128
18k
The Success of Rails: Ensuring Growth for the Next 100 Years
eileencodes
47
8.3k
Digital Ethics as a Driver of Design Innovation
axbom
PRO
1
370
Avoiding the “Bad Training, Faster” Trap in the Age of AI
tmiket
0
210
Designing Experiences People Love
moore
143
24k
Transcript
PLaMoを毎日の開発で 使い育てていく 株式会社 Preferred Networks 三上 裕明
PLaMoのdogfooding PLaMoを使う一番の目的: PLaMoの課題・問題点を見つけること PLaMoによる業務の効率化 タスク指示 結果 (成功) 2
PLaMoのdogfooding PLaMoを使う一番の目的: PLaMoの課題・問題点を見つけること PLaMoによる業務の効率化 タスク指示 結果 (成功) • PLaMoでなくても良い 3
PLaMoのdogfooding PLaMoを使う一番の目的: PLaMoの課題・問題点を見つけること PLaMoによる業務の効率化 PLaMoが失敗した事例の収集 タスク指示 タスク指示 結果 (成功) 結果
(失敗) • PLaMoでなくても良い 4
PLaMoのdogfooding PLaMoを使う一番の目的: PLaMoの課題・問題点を見つけること PLaMoによる業務の効率化 PLaMoが失敗した事例の収集 タスク指示 タスク指示 結果 (成功) 結果
(失敗) • PLaMoでなくても良い • PLaMoでのみ実現可能 5
PLaMoのdogfooding PLaMoを使う一番の目的: PLaMoの課題・問題点を見つけること PLaMoによる業務の効率化 PLaMoが失敗した事例の収集 タスク指示 タスク指示 PLaMoが失敗する可能性のあるタスクでdogfoodingをしたい 結果 (成功)
結果 (失敗) • PLaMoでなくても良い • PLaMoでのみ実現可能 6
例: PLaMo開発レポジトリのCI監視 CIの監視: 長期間の動作が必要なagentタスクの一例 1 CIの状況取得 2 ログの調査 3 エラーの判定
CI実行中 修正すべき エラー retryで治る エラー・障害 4 CIのリトライ 7
例: PLaMo開発レポジトリのCI監視 CIの監視: 長期間の動作が必要なagentタスクの一例 1 CIの状況取得 2 ログの調査 3 エラーの判定
修正すべき エラー LLM agentの必要性: retryで治る flakyなテストの失敗などを判定 エラー・障害 CI実行中 する必要がある 4 CIのリトライ 8
例: PLaMo開発レポジトリのCI監視 CIの監視: 長期間の動作が必要なagentタスクの一例 1 CIの状況取得 2 ログの調査 3 エラーの判定
修正すべき エラー LLM agentの必要性: retryで治る flakyなテストの失敗などを判定 エラー・障害 CI実行中 する必要がある 難しい点: チェック→待機→チェック のループが必要 4 CIのリトライ 9
PLaMo-3.0-Primeを使ってみる: 課題 実際にPLaMo-3.0-Primeを使ってみた時のよくあるパターン PR ABCのCIが終わるまで待機 10
PLaMo-3.0-Primeを使ってみる: 課題 実際にPLaMo-3.0-Primeを使ってみた時のよくあるパターン PR ABCのCIが終わるまで待機 tool call: CIの状態をチェックするscript 11
PLaMo-3.0-Primeを使ってみる: 課題 実際にPLaMo-3.0-Primeを使ってみた時のよくあるパターン PR ABCのCIが終わるまで待機 tool call: CIの状態をチェックするscript 状態: 実行中
12
PLaMo-3.0-Primeを使ってみる: 課題 実際にPLaMo-3.0-Primeを使ってみた時のよくあるパターン PR ABCのCIが終わるまで待機 tool call: CIの状態をチェックするscript 状態: 実行中
CIは実行中なのでしばらく待機します。 (sessionが終了してしまう) 13
PLaMo-3.0-Primeを使ってみる: 課題 実際にPLaMo-3.0-Primeを使ってみた時のよくあるパターン 失敗事例: 長期間の待機が現在難しい ABCのCIが終わるまで待機 •PR現在のPLaMoに足りない能力を発見できた 問題点: tool call:
CIの状態をチェックするscript • 具体的な改善点が不明のままのことが多い • 普段から使い続けるのは難しい 状態: 実行中 モデル更新時に改めてテストしづらい CIは実行中なのでしばらく待機します。 (sessionが終了してしまう) 14
PLaMo-3.0-Primeを使ってみる: 外部ロジックの利用 外部ロジックを追加することで、この問題は回避できる while True: status = PLaMoで監視 if status
== “retry”: PLaMoによるretry continue if status == “finish”: break PR ABCのCIの状況を教えて tool call: CIの状態をチェック 状態: 実行中 status: executing 15
PLaMo-3.0-Primeを使ってみる: 外部ロジックの利用 外部ロジックを追加することで、この問題は回避できる while True: PR ABCのCIの状況を教えて status = PLaMoで監視
if status == “retry”: tool call: CIの状態をチェック PLaMoによるretry 外部ロジックによる支援 continue • == 外部ロジックで支援したことが具体的な改善点となる if status “finish”: 状態: 実行中 • 普段から使い続けてモデルの性能を継続的に確認できる break 課題: status: executing • モデル更新時に支援を外してテストしづらい 16
OpenAI API proxyによるuser code共通化 (1) 外部ロジックをOpenAI APIとして実装することで、使い方を共通化 状態: 実行中 CIは実行中です
tool call: CIの状態をチェックするscript . . . 17
OpenAI API proxyによるuser code共通化 (1) 外部ロジックをOpenAI APIとして実装することで、使い方を共通化 状態: 実行中 CIは実行中です
呼び出し側のコードは tool call: CIの状態をチェックするscript 普通のモデル呼び出しと同じ . . . 18
OpenAI API proxyによるuser code共通化 (1) 外部ロジックをOpenAI APIとして実装することで、使い方を共通化 状態: 実行中 CIは実行中です
呼び出し側のコードは tool call: CIの状態をチェックするscript 普通のモデル呼び出しと同じ . . . proxyサーバは • 外部ロジックによる処理 • PLaMoの呼び出し を使い分けて行動する 19
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 20
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 監視/retryのために呼び出すtoolを決める 21
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 監視/retryのために呼び出すtoolを決める 22 tool callの要求
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 監視/retryのために呼び出すtoolを決める tool callの出力が 返ってきた 出力からCIの状態を判定 23 tool callの要求
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 監視/retryのために呼び出すtoolを決める tool callの出力が 返ってきた 実行中 または retryが必要 出力からCIの状態を判定 24 tool callの要求
OpenAI API proxyによるuser code共通化 (2) proxy内部の処理は以下のようになっている API requests (chat completion)
最初の呼び出し 監視/retryのために呼び出すtoolを決める tool callの出力が 返ってきた tool callの要求 実行中 または retryが必要 出力からCIの状態を判定 25 結果を出力
OpenAI API proxyによるuser code共通化 (3) 使い方が共通なため、様々な条件での調査が容易 1: 現在のPLaMoを使った実験・調査 現在のPLaMoの課題を発見 26
OpenAI API proxyによるuser code共通化 (3) 使い方が共通なため、様々な条件での調査が容易 1: 現在のPLaMoを使った実験・調査 現在のPLaMoの課題を発見 2:
proxyを導入した運用 業務の効率化にPLaMoを利用 27
OpenAI API proxyによるuser code共通化 (3) 使い方が共通なため、様々な条件での調査が容易 1: 現在のPLaMoを使った実験・調査 現在のPLaMoの課題を発見 2:
proxyを導入した運用 業務の効率化にPLaMoを利用 3: 開発中の新しいPLaMoに置き換え モデルの性能改善を評価 28
PLaMoの開発での利用状況 (事前学習チーム) 導入タスク数 (proxyを介して): 5件 • Q&A slackbot • CIの監視
• etc. 利用token数 (6月) • Input: 554M token • Output: 32M token 29
まとめ: PLaMoを継続的にdogfoodingするために dogfooding • 自分たちの業務が効率化することは必須 • その上で、PLaMoが失敗する可能性のあるタスクに適用することが大事 失敗する可能性のあるタスクへの適用 • 失敗する可能性のあるワークフローは日々の業務で使いづらい
• 外部ロジックの補助を入れることで、使い続けられるようになる ◦ 外部ロジックの存在がPLaMoの改善点を示す ◦ 外部ロジックをOpenAI APIとして扱うことで、モデル評価が容易に 30