Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
[論文紹介] Probabilistic Matrix Factorization
Search
ysekky
January 27, 2015
Research
0
600
[論文紹介] Probabilistic Matrix Factorization
Gunosy研究会 #82 2015/01/27
ysekky
January 27, 2015
Tweet
Share
More Decks by ysekky
See All by ysekky
スタートアップの開発サイクルに学ぶ 研究活動の進め方 / research practices inspired by startup business strategy
ysekky
0
1.9k
[論文紹介] A Method to Anonymize Business Metrics to Publishing Implicit Feedback Datasets (Recsys2020) / recsys20-reading-gunosy-datapub
ysekky
3
2.5k
JSAI2020 OS-12 広告とAI オープニング / JSAI2020-OS-12-ads-and-ai-opening
ysekky
0
1.9k
JSAI2020インダストリアルセッション - Gunosyにおける研究開発 / jsai2020-gunosy-rd-examples
ysekky
1
730
ウェブサービス事業者における研究開発インターン[株式会社Gunosy] - テキストアナリティクスシンポジウム2019 / research-intern-case-study-at-gunosy
ysekky
0
2.6k
Gunosyにおけるニュース記事推薦/ news-recommendation-in-gunosy-webdbf2019
ysekky
1
1.4k
DEIM2019技術報告セッション - Gunosyの研究開発 / deim-2019-sponsor-session-gunosy-research
ysekky
0
980
Analysis of Bias in Gathering Information Between User Attributes in News Application (ABCCS 2018)
ysekky
1
2.2k
世代による政治ニュース記事の閲覧傾向の違いの分析 - JSAI2018 / Analysis of differences in viewing behavior of politics news by age
ysekky
0
3.8k
Other Decks in Research
See All in Research
メールからの名刺情報抽出におけるLLM活用 / Use of LLM in extracting business card information from e-mails
sansan_randd
2
140
医療支援AI開発における臨床と情報学の連携を円滑に進めるために
moda0
0
110
Geospecific View Generation - Geometry-Context Aware High-resolution Ground View Inference from Satellite Views
satai
1
100
テキストマイニングことはじめー基本的な考え方からメディアディスコース研究への応用まで
langstat
1
120
Physics of Language Models: Part 3.1, Knowledge Storage and Extraction
sosk
1
950
文献紹介:A Multidimensional Framework for Evaluating Lexical Semantic Change with Social Science Applications
a1da4
1
220
論文紹介/Expectations over Unspoken Alternatives Predict Pragmatic Inferences
chemical_tree
1
260
第79回 産総研人工知能セミナー 発表資料
agiats
2
160
Weekly AI Agents News! 7月号 論文のアーカイブ
masatoto
1
220
Weekly AI Agents News! 9月号 プロダクト/ニュースのアーカイブ
masatoto
2
140
非ガウス性と非線形性に基づく統計的因果探索
sshimizu2006
0
360
ダイナミックプライシング とその実例
skmr2348
3
400
Featured
See All Featured
Dealing with People You Can't Stand - Big Design 2015
cassininazir
364
24k
Statistics for Hackers
jakevdp
796
220k
Raft: Consensus for Rubyists
vanstee
136
6.6k
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
126
18k
Why You Should Never Use an ORM
jnunemaker
PRO
54
9.1k
GraphQLの誤解/rethinking-graphql
sonatard
67
10k
Building a Modern Day E-commerce SEO Strategy
aleyda
38
6.9k
Product Roadmaps are Hard
iamctodd
PRO
49
11k
個人開発の失敗を避けるイケてる考え方 / tips for indie hackers
panda_program
93
16k
Making Projects Easy
brettharned
115
5.9k
GitHub's CSS Performance
jonrohan
1030
460k
Why Our Code Smells
bkeepers
PRO
334
57k
Transcript
[論文紹介] Probalis,c Matrix Factoriza,on Ruslan Salakhutdinov
and Andriy Mnih (University of Toronto) NIPS2008 Yoshifumi Seki (Gunosy Inc) 2015.01.27 @Gunosy研究会 #82
概要 • 協調フィルタリングのための次元削減手法の 提案 • NeQlix – 超大規模なデータ
• pLSAなどのギブスサンプリングでは遅いし正確性に欠 ける – バランスの悪いデータ(スパース, 偏り有り) • SVDなどでは評価値が少ないユーザの評価が平均的 なユーザに近づいてしまう
Probabilis,c Matrix Factoriza,on • MのアイテムとNのユー ザ • それぞれD次元の次元 を与えることを考える
• V, Uの各要素は平均0 のガウス分布を仮定
Probabilis,c Matrix Factoriza,on I : i, jに評価値があるときに1, それ以外は0 U, Vの対数事後分布を,
下記の条件の元で最大化する
Probabilis,c Matrix Factoriza,on • 値がすべて満たされている場合にはSVDの確率 モデルへの拡張とみなすことができる • ユーザとアイテムの内積をロジスティクス関数に 通す
• 評価値を0-‐1の範囲にMapする
Automa,c Complexity Control • 新しいデータにも適切に反映できるようにした い – 次元数を調整するのはアンバランスなデータの 場合は適切ではない
– これまでにないようなデータが入ってくる可能性 がある. • 分散のパラメータを調整することで対応させ る
Constrained PMF • PMFではデータが少な いユーザの情報が平均 に近づいてしまう • そのユーザが評価した アイテムの情報が評価
されやすいように制約 を与える
Constrained PMF ユーザのベクタは以下のようにして与えられる よって評価値は以下のようなモデルになる PMFと同様にパラメータ推定を行いモデルを生成する
Experimental Result • Dataset – a subset of NeQlix
• 50,000 users • 1,850 movies • 1,082,982 values – 半分以上は10個以下の評価しかない(sparse) • Parameter – Learning rate: 0.005 – Momentum: 0.9 – D: 30 – λ U, λV, λW, λY = 0.002
Experimental Result
None
None