Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Learning Lightweight Lane Detection CNNs by Sel...
Search
catla
September 13, 2019
Research
630
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
Learning Lightweight Lane Detection CNNs by Self Attention Distillation(ICCV2019)の紹介
catla
September 13, 2019
More Decks by catla
See All by catla
ベイズ深層学習(6.3)
catla
2
240
ベイズ深層学習(6.2)
catla
3
240
[読み会資料] Federated Learning for Vision-and-Language Grounding Problems
catla
0
330
ベイズ深層学習(5.1~5.2)
catla
0
240
ベイズ深層学習(4.1)
catla
0
470
ベイズ深層学習(3.3~3.4)
catla
19
11k
ベイズ深層学習(2.2~2.4)
catla
6
1.3k
23回アルゴリズムコンテスト 1位解法
catla
6
690
TGS Salt Identification Challenge 12th place solution
catla
3
12k
Other Decks in Research
See All in Research
【Zozo Research 技術共有会】三次元領域の現在と展望
mickey_0226
3
480
SLAMはどこまで解決されたのか?
tomonom
0
850
Fukui Shibiten 39 - AI Art
butchi
0
150
重要だけど測れていないもの:高齢者ケアの見えない課題
theoriatec2024
0
420
Cross-Media Information Spaces and Architectures
signer
PRO
0
320
CVPR2026論文紹介_VLMにとって良いvision encoderとは何か?Rethinking Model Selection in VLM Through the Lens of Gromov-Wasserstein Distance
kobayashi31
1
170
【中間報告】国会議員の立法・政策実務を支える環境を巡る現状と課題
polipoli
0
330
Ghost in the 7‑Zip: The Shadow of Residential Proxies Creeping into Your Life
nttcom
0
1.6k
【ローカルAIに向き合う展示会vol.2】液体時間定数型モジュールを用いた オリジナルの双方向エンコーダーモデルNexteraBERT 推論速度向上検討並びにダウンストリーム評価
rikkabotan7
0
130
Sleuthcon Keynote - How Cybercriminals (ab)use AI
fr0gger
0
260
nlp2026 In-Context Learningに基づく経路案内のための地理的知識の活用方法に関する検討
takashiinui
0
110
PGDM: Physically Guided Diffusion Model for L Downscaling
satai
3
360
Featured
See All Featured
個人開発の失敗を避けるイケてる考え方 / tips for indie hackers
panda_program
123
22k
Mind Mapping
helmedeiros
PRO
1
290
A brief & incomplete history of UX Design for the World Wide Web: 1989–2019
jct
2
420
Easily Structure & Communicate Ideas using Wireframe
afnizarnur
194
17k
世界の人気アプリ100個を分析して見えたペイウォール設計の心得
akihiro_kokubo
PRO
72
40k
Large-scale JavaScript Application Architecture
addyosmani
515
110k
HTML-Aware ERB: The Path to Reactive Rendering @ RubyCon 2026, Rimini, Italy
marcoroth
3
360
Sam Torres - BigQuery for SEOs
techseoconnect
PRO
0
440
So, you think you're a good person
axbom
PRO
2
2.1k
4 Signs Your Business is Dying
shpigford
187
22k
Mozcon NYC 2025: Stop Losing SEO Traffic
samtorres
1
410
Making the Leap to Tech Lead
cromwellryan
135
10k
Transcript
https://arxiv.org/abs/1908.00821 桂 尚輝 (Katsura Naoki) #7【画像処理 & 機械学習】論文LT会 2019.09.13
どんなもの? 先行研究と比べてどこがすごい? 技術や手法のキモはどこ? どうやって有効かを検証した? 議論はある? 入力画像(RGB)から車線を検出する.
蒸留に追加データやラベルを必要とせず,先行研究である message passing機能を有するSCNNは順伝播に全体の 35%の時間を占めるのに対し,提案手法の推論時間はベー スモデルと同程度で精度の向上を達成. ベーシックな蒸留は,教師モデルを用いて新たなモデルを 学習させるが,提案手法のSelf Attention Distillation(SAD) は,自分自身の深いレイヤーにおけるアテンションマップを 浅いレイヤーの蒸留ラベルに使用. したがって, 教師モデ ル等から得られる追加ラベルが必要なく, モデル自体も大 きくならない. Lane Detectionにおける3つのベンチマーク(TuSimple, BDD100K, CULane)で実験を行い,先行研究との比較や SADに関するablation studyを行い有効性を検証. SADを導入することで各レイヤーのアテンションマップが 良くなった. 細部にこだわるタスクにおいても有効かもしれ ない.
背景&先行研究 (1) 車線が画像に対してスパースであるので学習が難しい問題. (2) また,前に走ってる車によってレーンが見えない,実際のレーンが曖昧に引かれている(視覚情報が弱い),路 面状況が悪いといった時にうまく予測できない問題もある.
(3) 先行研究でSoTAなSCNNはmessage passing(MP)によって精度向上を達成したがMP部分に推論時間の 35%が占められていて計算コストが高い. (4) アプローチ方法としては,セグメンテーションとして解く,セグメンテーションしたのちに点をサンプリングして 多項式に変形,多項式のパラメータを予測する方法があるっぽい (?). この論文はsemantic segmentationで解く
Self Attention Distillation 一つレイヤーの深いアテンションマップを蒸 留に用いる教師ラベルとして使用する. 蒸留に対する損失関数は, L2 Loss
Self Attention Distillation 次ココ!
AT-GEN Bilinear Upsample Spatial Softmax p=2で実験したもの が一番よかったらし い C ×
H × W H × W H’ × W’ H’ × W’
Result (Attention map)
Result (vs Previous work)
Result (vs Deep supervision)
Message Passing (MP) https://arxiv.org/abs/1712.06080 MRF/CRF SCNN 近くのピクセル情報を関連づける
Message Passing (MP) https://arxiv.org/abs/1712.06080 CNNは、細く連続な物体や大きな物体のsemantic情報 に弱いらしく、SCNNでそれを改善できたそう