Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Learning Lightweight Lane Detection CNNs by Sel...
Search
catla
September 13, 2019
Research
640
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
Learning Lightweight Lane Detection CNNs by Self Attention Distillation(ICCV2019)の紹介
catla
September 13, 2019
More Decks by catla
See All by catla
ベイズ深層学習(6.3)
catla
2
240
ベイズ深層学習(6.2)
catla
3
240
[読み会資料] Federated Learning for Vision-and-Language Grounding Problems
catla
0
340
ベイズ深層学習(5.1~5.2)
catla
0
250
ベイズ深層学習(4.1)
catla
0
470
ベイズ深層学習(3.3~3.4)
catla
19
11k
ベイズ深層学習(2.2~2.4)
catla
6
1.3k
23回アルゴリズムコンテスト 1位解法
catla
6
690
TGS Salt Identification Challenge 12th place solution
catla
3
12k
Other Decks in Research
See All in Research
XDPerf: A High-Performance Traffic Generator Built with WASM and eBPF
takehaya
1
290
OWASP AISVS - C7
shiell
1
640
Language and AI
ayaniwa
0
220
最先端NLP 2026 論文紹介: Wait, Wait, Wait... Why Do Reasoning Models Loop? / SNLP Paper Review: Wait, Wait, Wait... Why Do Reasoning Models Loop?
tkng
0
210
CVPR2026論文紹介_VLMにとって良いvision encoderとは何か?Rethinking Model Selection in VLM Through the Lens of Gromov-Wasserstein Distance
kobayashi31
1
210
「AIとWhyを深堀る」をAIと深堀る
iflection
0
610
[最先端NLP勉強会2026] Checklists Are Better Than Reward Models For Aligning Language Models
nzw0301
1
310
論文読み会 SNLP2026 Tau2-Bench: Evaluating Conversational Agents in a Dual-Control Environment
s_mizuki_nlp
0
230
VLMの推論を高速化する視覚トークン削減の仕組み
tattaka
2
300
超効率化への挑戦:1bit LLMの現状と展望
yumaichikawa
0
670
IA for theory
gpeyre
1
400
SAKURAONE:An Open Ethernet-based AI HPC System And Its Observed Workload Dynamicsin a Single-Tenant LLM Development Environment
yuukit
1
580
Featured
See All Featured
Have SEOs Ruined the Internet? - User Awareness of SEO in 2025
akashhashmi
0
490
Highjacked: Video Game Concept Design
rkendrick25
PRO
1
450
Save Time (by Creating Custom Rails Generators)
garrettdimon
PRO
32
4.6k
Odyssey Design
rkendrick25
PRO
2
800
Noah Learner - AI + Me: how we built a GSC Bulk Export data pipeline
techseoconnect
PRO
0
430
Breaking role norms: Why Content Design is so much more than writing copy - Taylor Woolridge
uxyall
1
390
Heart Work Chapter 1 - Part 1
lfama
PRO
8
36k
The Anti-SEO Checklist Checklist. Pubcon Cyber Week
ryanjones
0
230
Testing 201, or: Great Expectations
jmmastey
46
8.3k
HDC tutorial
michielstock
2
850
Game over? The fight for quality and originality in the time of robots
wayneb77
1
260
Ten Tips & Tricks for a 🌱 transition
stuffmc
0
190
Transcript
https://arxiv.org/abs/1908.00821 桂 尚輝 (Katsura Naoki) #7【画像処理 & 機械学習】論文LT会 2019.09.13
どんなもの? 先行研究と比べてどこがすごい? 技術や手法のキモはどこ? どうやって有効かを検証した? 議論はある? 入力画像(RGB)から車線を検出する.
蒸留に追加データやラベルを必要とせず,先行研究である message passing機能を有するSCNNは順伝播に全体の 35%の時間を占めるのに対し,提案手法の推論時間はベー スモデルと同程度で精度の向上を達成. ベーシックな蒸留は,教師モデルを用いて新たなモデルを 学習させるが,提案手法のSelf Attention Distillation(SAD) は,自分自身の深いレイヤーにおけるアテンションマップを 浅いレイヤーの蒸留ラベルに使用. したがって, 教師モデ ル等から得られる追加ラベルが必要なく, モデル自体も大 きくならない. Lane Detectionにおける3つのベンチマーク(TuSimple, BDD100K, CULane)で実験を行い,先行研究との比較や SADに関するablation studyを行い有効性を検証. SADを導入することで各レイヤーのアテンションマップが 良くなった. 細部にこだわるタスクにおいても有効かもしれ ない.
背景&先行研究 (1) 車線が画像に対してスパースであるので学習が難しい問題. (2) また,前に走ってる車によってレーンが見えない,実際のレーンが曖昧に引かれている(視覚情報が弱い),路 面状況が悪いといった時にうまく予測できない問題もある.
(3) 先行研究でSoTAなSCNNはmessage passing(MP)によって精度向上を達成したがMP部分に推論時間の 35%が占められていて計算コストが高い. (4) アプローチ方法としては,セグメンテーションとして解く,セグメンテーションしたのちに点をサンプリングして 多項式に変形,多項式のパラメータを予測する方法があるっぽい (?). この論文はsemantic segmentationで解く
Self Attention Distillation 一つレイヤーの深いアテンションマップを蒸 留に用いる教師ラベルとして使用する. 蒸留に対する損失関数は, L2 Loss
Self Attention Distillation 次ココ!
AT-GEN Bilinear Upsample Spatial Softmax p=2で実験したもの が一番よかったらし い C ×
H × W H × W H’ × W’ H’ × W’
Result (Attention map)
Result (vs Previous work)
Result (vs Deep supervision)
Message Passing (MP) https://arxiv.org/abs/1712.06080 MRF/CRF SCNN 近くのピクセル情報を関連づける
Message Passing (MP) https://arxiv.org/abs/1712.06080 CNNは、細く連続な物体や大きな物体のsemantic情報 に弱いらしく、SCNNでそれを改善できたそう