Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
【ICML読み会】Unsupervised Deep Embedding for Cluste...
Search
Hayato Maki
July 16, 2016
Technology
1.4k
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
【ICML読み会】Unsupervised Deep Embedding for Clustering Analysis
Hayato Maki
July 16, 2016
More Decks by Hayato Maki
See All by Hayato Maki
Billion-scale Embedding for E-commerce Recommendation in Alibaba
hamaki
0
130
Today was a Good Day: The Daily Life of Software Developers
hamaki
0
130
論文紹介:Relaxed Softmax for PU Learning
hamaki
3
1.1k
MIRU 2019 Lunch on Seminar
hamaki
1
300
コーディネート整合性を考慮したカテゴリ間推薦
hamaki
0
1.2k
Regularization_The Element of Statical Learning
hamaki
0
230
Neural Activity During Sentence Processing as Reflected in Theta, Alpha, Beta, and Gamma Oscillations
hamaki
0
270
Other Decks in Technology
See All in Technology
行動するAIのためのオントロジー | DevRev — Encraft #26.pdf
dvrv_tknrszk
1
450
人にやさしく、AIにやさしく、書き手を選ばないIaCのガードレール再考 / Rethinking IaC Guardrails for Humans and AI Alike
kohbis
5
1.4k
.NET WebAssemblyで実現するクライアントサイドAI推論:NuGetからViteまで、2つのエコシステムを繋ぐビルド戦略
yamachu
1
960
OpenClawでAzure DevOpsのWiki更新を自動化する - クラウドAIだけでは届かない場所へ
yutakaosada
0
110
地方移住と都心キャリアの両立は「金・時間・人」のリソースをフル活用すれば実現できる!〜Snowflake女子会 vol.8
snowwmn0824
0
130
【ゲームメーカーズスクランブル2026】『Shadowverse: Worlds Beyond』UIとアニメーションで実現する最高のユーザー体験を叶えるプロトタイピング
cygames
PRO
1
640
AI感のないAWS構成図をAIエージェントに描かせたい!
sagochiko
2
450
その Lambda、8分で 管理者権限まで奪われます
k1nakayama
7
3.8k
「ピッケル本」日本語版は4.0(第6版)が出版されるべき / pickaxe4-nagoyark05
kakutani
2
310
AgentCore Runtime上にAgentic Coding基盤を構築・展開する際の設計ポイントと限界点 / Design considerations and limitations when building an agentic coding platform on AgentCore Runtime
har1101
7
780
Mastering Agentic Development: Harness Engineering for Effective Coding Agents
konippi
3
600
Kiro Meetup #8 Kiro アップデート (2026/3/21〜2026/9/24)
katzueno
1
290
Featured
See All Featured
RailsConf 2023
tenderlove
30
1.6k
Believing is Seeing
oripsolob
1
230
Avoiding the “Bad Training, Faster” Trap in the Age of AI
tmiket
0
250
Design in an AI World
tapps
1
330
Skip the Path - Find Your Career Trail
mkilby
1
240
Optimizing for Happiness
mojombo
378
71k
Build your cross-platform service in a week with App Engine
jlugia
234
19k
10 Git Anti Patterns You Should be Aware of
lemiorhan
PRO
659
62k
Distributed Sagas: A Protocol for Coordinating Microservices
caitiem20
333
23k
How to Grow Your eCommerce with AI & Automation
katarinadahlin
PRO
2
290
Sam Torres - BigQuery for SEOs
techseoconnect
PRO
0
550
Mind Mapping
helmedeiros
1
370
Transcript
ICML2016จհ Unsupervised Deep Embedding for Clustering Analysis Ross Girshick Jungian
Xie Ali Farhadi University of Washington Facebook AI Research University of Washington ൃදऀ ਅ༐ਓ ಸྑઌՊֶٕज़େֶӃେֶ ใՊֶݚڀՊ ത࢜ޙظ՝ఔ ೳίϛϡχέʔγϣϯݚڀࣨ 2016/07/16 @NAIST
3ߦͰཁ • ରɿݹయతͳΫϥελϦϯά • ख๏ɿਂֶशΛར༻ͨ࣍͠ݩݮύ ϥϝλͱΫϥελϦϯάͷಉ࣌ ࠷దԽ • ݁Ռɿैདྷख๏ΑΓߴ͍ਫ਼ɼ͍ ܭࢉ࣌ؒΛ࣮ݱ
ΫϥελϦϯάͷؔ࿈ݚڀ • k-means ٴͼ ࠞ߹ਖ਼نϞσϧ(GMM) • ೖྗͷ࣍ݩ͕ߴ͍ͱࣦഊ͍͢͠ • ࣍ݩݮͱΫϥελϦϯάΛಉ࣌ʹߦ͏ख๏ •
࣍ݩۭؒʹࣸ૾ɼࣸ૾ͨ͠ઌͰΫϥελϦϯά • ैདྷख๏ઢܗࣸ૾ͷΈ • εϖΫτϥϧɾΫϥελϦϯά • σʔλͷάϥϑߏΛར༻͢Δख๏ • k-meansΑΓྑ͍݁ՌʹͳΔ͜ͱ͕ଟ͍ • ܭࢉྔ͕αϯϓϧͷ̎·ͨ̐ʹൺྫ
ه߸ • σʔλɿ • σʔλɿ • Ϋϥελͷʢࣄલʹܾఆʣɿ • ࣸ૾ɿ •
ɹ ͷ࣍ݩ <<< ͷ࣍ݩ • ࣸ૾ͷύϥϝλ ΛDNNͰֶश • ࣸ૾ઌͷσʔλɿ • ηϯτϩΠυʢΫϥελΛද͢Δʣɿ n { xi 2 X }n i=1 k zi = f✓( xi) ✓ {zi 2 Z}n i=1 {µj 2 Z}k i=1 zi = f✓( xi) zi = f✓( xi)
ఏҊ๏ͷྲྀΕ ॳظԽ ࣍ݩݮ ΫϥελׂΓͯ KL divergenceܭࢉ ύϥϝλߋ৽
࣍ݩݮ • ਂֶशΛར༻ͨ͠ඇઢܗͳ࣍ݩԽࣸ૾ f✓ : X ! Z { xi
2 X }n i=1 zi = • ڭࢣͳֶ͠शͷͨΊɼަ ࠩݕূ๏ʹΑΔϋΠύʔύ ϥϝλͷௐͰ͖ͳ͍ • ͦͷͨΊɼΑ͘ΘΕΔ ωοτϫʔΫߏΛ༻ • ֤ͷ࣍ݩ (input)-500-500-2000-10 • શ݁߹ [van der Maaten, 09]
ΫϥελׂΓͯ Soft Asignment • ࣸ૾͞Εͨσʔλ ͱηϯτϩΠυ ͷྨࣅ ई (soft assignment)
ɼ ͕̹൪ͷΫϥελʹೖΔ֬ͱͯ͠ ղऍͰ͖Δɽ qij = 1 + kzi µj0 k2/↵ (↵+1)/2 P j0 (1 + kzi µj0 k2/↵) (↵+1)/2 ↵ = 1 {zi 2 Z}n i=1 µj [van der Maaten & Hinton, 08] qij = 1 + kzi µj0 k2/↵ (↵+1)/2 P j0 (1 + kzi µj0 k2/↵) (↵+1)/2 {zi 2 Z}n i=1 • ڭࢣͳֶ͠शʹ͓͍ͯɼަࠩݕূ๏͑ͳ͍ ͨΊɼ ʹݻఆɽ
KLμΠόʔδΣϯεʹΑΔDNNֶश • ఆతͳׂΓͯ • ඪʢཧతͳΫϥελϦϯάΛߦ͏ͱߟ͑Β ΕΔʣ • PͱQͷKLμΠόʔδΣϯεΛ࠷খԽ͢ΔΑ͏ʹDNN Λֶश •
Pͷઃఆ͕ຊख๏ͷΩϞ
ύϥϝλߋ৽ • DNNͷύϥϝλθ ͱ ηϯτϩΠυ μj Λߋ৽ • SGDͰߋ৽ (θόοΫϓϩύήʔγϣϯ)
ॳظԽ • DNNͷॳظԽɿ Stacked Auto Encoder Λར༻ • ηϯτϩΠυͷॳظԽɿॳظԽDNNΛར༻ͯ࣍͠ݩ ݮ͠ɼࣸ૾ઌͰk-means
࣮ݧ • σʔληοτ • ൺֱख๏ • k-means • LDGMI (εϖΫτϥϧɾΫϥελϦϯά)
• SEC (εϖΫτϥϧɾΫϥελϦϯά) • Without back propagation
࣮ • Stacked Auto EncoderͷॳظԽ • ฏۉ0ɼඪ४ภࠩ0.01ͷਖ਼نΛͬͨ ཚͰॏΈΛॳظԽ • ֤͝ͱʹ50000ճ෮ʢ20%Dropoutʣ
• Auto EncoderશମͰ100000ճ෮ͯ͠ fine tuning (Dropoutແ͠) • ϛχόοναΠζ=256 • ֶश=0.1 ←20000෮ຖʹ1/10
࣮ • ηϯτϩΠυͷॳظԽ • ҟͳΔॳظͰ20ճ࣮ߦͯ͠ϕετͳ ͷΛબ • KLμΠόʔδΣϯεͷ࠷খԽ • ֶश=0.01
(ݻఆ) • ऩଋఆ • ΫϥελͷׂΓ͕ͯมԽ͢Δσʔλ͕ 0.1%ҎԼʹͳΔ·Ͱ
ධՁج४ • Unsupervised Clustering Accuracy (ACC) • pi ɿਅͷϥϕϧ •
qi ɿΞϧΰϦζϜ͕ग़ྗͨ͠ϥϕϧ • map()ɿϥϕϧ͔ΒΫϥελͷ࠷దͳϚοϐϯά
݁Ռ • ఏҊ๏͕ϕετͷੑೳ • REUTERSʹ͍ͭͯ • ఏҊ๏ͷֶश࣌ؒ30ఔ • LDMGIͱSECϲ݄Ҏ্ͷܭࢉ࣌ؒͱςϥ ୯ҐͷϝϞϦ͕ඞཁ
ϋΠύʔύϥϝλʹର͢Δؤ݈ੑ • ҟͳΔ9ͭͷϋΠύʔύϥϝλʢΞχʔϦϯάʣ ͰੑೳΛൺֱ • ఏҊ๏ϋΠύʔύϥϝλͷมಈʹରͯ͠ؤ݈ɼ ͔ͭσʔληοτʹඇґଘ • ڭࢣͳֶ͠शʹ͓͍ͯॏཁͳੑ࣭
ඪPͷੑ࣭ • qij ͕େ͖΄Ͳ(֬৴͕େ͖͍΄Ͳ)ɼޯ͕ େ͖͘ͳΔ ˠP·͍͠ੑ࣭Λ͍࣋ͬͯΔ
࣍ݩݮͷ෮࠷దԽʹΑΔޮՌ • t-SNEΛར༻ͨ͠ՄࢹԽ [van der Maaten & Hinton, 08] •
ߋ৽͕ਐΉ΄ͲΫϥελʔͷ͕໌֬ʹ
Auto EncoderʹΑΔಛநग़ͷޮՌ • Auto EncoderͰಛநग़ˠ֤ΞϧΰϦζϜͰॲཧ • Auto EncoderʹΑΔߩݙ͕େ͖͍
ෆۉҰͳσʔληοτʹର͢Δؤ݈ੑ • αϯϓϧ͕࠷খͷΫϥεͷαϯϓϧΛɼ ࠷େͷαϯϓϧͷΫϥεͷrmin ഒʹઃఆɼ ͦͷଞͷΫϥε0.1ͣͭ૿͍ͯ͘͠ • ఏҊ๏αϯϓϧͷෆۉҰੑʹରͯ͠ؤ݈
݁ • ఏҊ๏ɼਂֶशΛར༻ͨ࣍͠ݩݮʹΑΓΫϥ ελϦϯάͷੑೳΛ্ • ࣍ݩݮͷύϥϝλͱΫϥελϦϯάͷ݁ՌΛಉ ࣌ʹ࠷దԽ • ΫϥελϦϯάఆతͳग़ྗͱඪͱͷKL μΠόʔδΣϯεΛଛࣦؔͱͯ͠όοΫϓϩύ
ήʔγϣϯ • ैདྷ๏ΑΓߴਫ਼͔ͭߴʢܭࢉ࣌ؒαϯϓϧ ʹରͯ͠ઢܗʹൺྫʣɼσʔληοτඇґଘɼϋΠύʔ ύϥϝλඇґଘɼαϯϓϧͷෆۉҰੑʹରͯ͠ؤ݈
Ҏ্