Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Off-Policy Evaluation and Learning for Matching...
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
Yudai Hayashi
November 09, 2025
Research
0
89
Off-Policy Evaluation and Learning for Matching Markets
RecSys 2025 論文読み会での発表資料です。
https://connpass.com/event/372676/
Yudai Hayashi
November 09, 2025
Tweet
Share
More Decks by Yudai Hayashi
See All by Yudai Hayashi
ジョブマッチングプラットフォームにおける推薦アルゴリズムの活用事例
yudai00
0
99
ユーザーのプロフィールデータを活用した推薦精度向上の取り組み
yudai00
0
680
MCP Clientを活用するための設計と実装上の工夫
yudai00
1
1.3k
人とシゴトのマッチングを実現するための機械学習技術
yudai00
1
79
MCPを理解する
yudai00
18
14k
データバリデーションによるFeature Storeデータ品質の担保
yudai00
1
240
「仮説行動」で学んだ、仮説を深め ていくための方法
yudai00
8
2k
相互推薦システムでのPseudo Label を活用したマッチ予測精度向上の取り組み
yudai00
1
1.1k
Wantedly Visitにおけるフリーワード検索時の推薦のオンライン化事例紹介
yudai00
1
330
Other Decks in Research
See All in Research
"主観で終わらせない"定性データ活用 ― プロダクトディスカバリーを加速させるインサイトマネジメント / Utilizing qualitative data that "doesn't end with subjectivity" - Insight management that accelerates product discovery
kaminashi
15
20k
説明可能な機械学習と数理最適化
kelicht
2
940
Community Driveプロジェクト(CDPJ)の中間報告
smartfukushilab1
0
170
社内データ分析AIエージェントを できるだけ使いやすくする工夫
fufufukakaka
1
900
Can AI Generated Ambrotype Chain the Aura of Alternative Process? In SIGGRAPH Asia 2024 Art Papers
toremolo72
0
140
J-RAGBench: 日本語RAGにおける Generator評価ベンチマークの構築
koki_itai
0
1.3k
Sat2City:3D City Generation from A Single Satellite Image with Cascaded Latent Diffusion
satai
4
660
ForestCast: Forecasting Deforestation Risk at Scale with Deep Learning
satai
3
390
大規模言語モデルにおけるData-Centric AIと合成データの活用 / Data-Centric AI and Synthetic Data in Large Language Models
tsurubee
1
500
製造業主導型経済からサービス経済化における中間層形成メカニズムのパラダイムシフト
yamotty
0
480
2026年1月の生成AI領域の重要リリース&トピック解説
kajikent
0
360
AI in Enterprises - Java and Open Source to the Rescue
ivargrimstad
0
1.1k
Featured
See All Featured
Build The Right Thing And Hit Your Dates
maggiecrowley
39
3k
Understanding Cognitive Biases in Performance Measurement
bluesmoon
32
2.8k
How To Speak Unicorn (iThemes Webinar)
marktimemedia
1
380
Introduction to Domain-Driven Design and Collaborative software design
baasie
1
590
Scaling GitHub
holman
464
140k
"I'm Feeling Lucky" - Building Great Search Experiences for Today's Users (#IAC19)
danielanewman
231
22k
Winning Ecommerce Organic Search in an AI Era - #searchnstuff2025
aleyda
1
1.9k
The AI Search Optimization Roadmap by Aleyda Solis
aleyda
1
5.2k
Reality Check: Gamification 10 Years Later
codingconduct
0
2k
WENDY [Excerpt]
tessaabrams
9
36k
Building Flexible Design Systems
yeseniaperezcruz
330
40k
The AI Revolution Will Not Be Monopolized: How open-source beats economies of scale, even for LLMs
inesmontani
PRO
3
3k
Transcript
© 2025 Wantedly, Inc. INTERNAL ONLY Off-Policy Evaluation and Learning
for Matching Markets RecSys 2025 論文読み会 Nov. 9 2025 - Yudai Hayashi, Shuhei Goda and Yuta Saito
© 2025 Wantedly, Inc. INTERNAL ONLY 自己紹介 林 悠大 •
所属:ウォンテッドリー株式会社 • 経歴: ◦ 2022年にデータサイエンティストとして新卒入社 • 趣味: ◦ 音楽を聞くこと ◦ ウイスキー
© 2025 Wantedly, Inc. INTERNAL ONLY マッチングプラットフォームにおける推薦システム 企業 求職者 スカウト
返信 購入 ECプラットフォーム マッチングプラットフォーム ユーザー 商品 マッチング推薦の成功には、双方向の嗜好の一致が必要
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値:推薦システム(= 方策)の生み出す価値の定量化 ECプラットフォーム マッチングプラットフォーム
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値:推薦システム(= 方策)の生み出す価値の定量化 ECプラットフォーム マッチングプラットフォーム
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値:推薦システム(= 方策)の生み出す価値の定量化 ECプラットフォーム マッチングプラットフォーム
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値が正しく推定できることのインパクト 仮に既存の方策のデータから を推定することができれば、 •
A/B テストより低コストで方策評価が可能 → オフ方策評価 • 推定した方策価値 を目的関数として学習 することでより良いモデルを得るこ とができる → オフ方策学習
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値の代表的な推定量 ECプラットフォーム 非マッチング文脈において様々な推定量が提案されてきた
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値の代表的な推定量 ECプラットフォーム 非マッチング文脈において様々な推定量が提案されてきた :重要度重み
• IPS や DR で不偏推定を実現 • 正解ラベルがスパースなときや行動空間が 大きい時に、発散的に増大し推定値が不安 定化 (バリアンスの増大)
© 2025 Wantedly, Inc. INTERNAL ONLY 方策価値の代表的な推定量 非マッチング文脈において様々な推定量が提案されてきた マッチングプラットフォーム :重要度重み
• IPS や DR で不偏推定を実現 • 正解ラベルがスパースなときや行動空間が 大きい時に、発散的に増大し推定値が不安 定化 (バリアンスの増大) 双方向の嗜好が関連することにより、 正解ラベルがスパースに
© 2025 Wantedly, Inc. INTERNAL ONLY 提案手法 - DiPS :
スカウト送信ラベル : 推定スカウト返信確率 IPS part DM part スカウト送信と返信を別々に分けて扱う • 比較的密なスカウト送信ラベルは IPS のように重要度重みを利用して低バイアスに推定 • 疎なスカウト返信は、DM のように予測モデルを利用して低バリアンスに推定
© 2025 Wantedly, Inc. INTERNAL ONLY 提案手法 - DPR :
推定マッチ確率 スカウト送信と返信を別々に分けて扱う DiPS を DR 推定量と同じ形で拡張することで、さらにバリアンスを低減
© 2025 Wantedly, Inc. INTERNAL ONLY 評価指標 推定の正しさの指標 : 方策選択の正しさの指標
:
© 2025 Wantedly, Inc. INTERNAL ONLY 合成データによる検証結果 • 候補者数が多く、重要度重みが不安定になりやすい設定でもバリアンスを低く抑えられている •
従来手法よりも低 MSE, 低 Selection Error を達成
© 2025 Wantedly, Inc. INTERNAL ONLY 合成データによる検証結果 • 正解ラベルがスパースな設定においてもバリアンスを低く抑えられている •
推定モデルを使っているためバイアスは増加するが、スカウト送信側は重要度重みを利用している ため、DM よりバイアスの増加を抑えられている
© 2025 Wantedly, Inc. INTERNAL ONLY 合成データによる検証 - オフ方策学習 方策価値の推定値を最大化させるようにモデルを学習
既存方策の性能を示す基準線 (黒線) や、他の推定量を使って学習したときよりも高い性能を 示している
© 2025 Wantedly, Inc. INTERNAL ONLY 実データによる検証 Wantedly Visit の過去のオンラインテストの結果を使って検証
• バリアンスの低減効果が実データにおいても見られた • 従来手法 (IPS, DR) と比較して、バイアスも低下するような振る舞い ◦ 返信確率の誤差 + α で説明できる (詳細は論文を参照してください)
© 2025 Wantedly, Inc. INTERNAL ONLY まとめ • マッチングプラットフォームにおいて、信頼度高く新しい方策の価値を推定するための 2つの推定
量 DiPS、DPR を提案 • 合成データと Wantedly Visit の実データの両方を使って提案手法の有効性を実証 • オフ方策学習においても、従来手法よりも高い性能のモデルを得ることができることを実証 ブログ記事 arXiv