Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Learning Lightweight Lane Detection CNNs by Sel...
Search
catla
September 13, 2019
Research
630
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
Learning Lightweight Lane Detection CNNs by Self Attention Distillation(ICCV2019)の紹介
catla
September 13, 2019
More Decks by catla
See All by catla
ベイズ深層学習(6.3)
catla
2
240
ベイズ深層学習(6.2)
catla
3
240
[読み会資料] Federated Learning for Vision-and-Language Grounding Problems
catla
0
330
ベイズ深層学習(5.1~5.2)
catla
0
240
ベイズ深層学習(4.1)
catla
0
470
ベイズ深層学習(3.3~3.4)
catla
19
11k
ベイズ深層学習(2.2~2.4)
catla
6
1.3k
23回アルゴリズムコンテスト 1位解法
catla
6
690
TGS Salt Identification Challenge 12th place solution
catla
3
12k
Other Decks in Research
See All in Research
言語モデルから言語について語る際に押さえておきたいこと
eumesy
PRO
6
2.5k
通時的な類似度行列に基づく単語の意味変化の分析
rudorudo11
0
340
COMETAを用いたデータ民主化運動の歴史
sazimai
0
120
適応的スパムフィルタのための軽量な類似メッセージカウンタ / jsai2026-adaptive-spam-filter
monochromegane
0
4.4k
GLIM とMegaParticles:正規分布近似の限界とタイトカップリング&パーティクルフィルタの進展 / GLIM and MegaParticles : Progress of the distribution representation in SLAM
koide3
0
610
CVPR2026論文紹介_VLMにとって良いvision encoderとは何か?Rethinking Model Selection in VLM Through the Lens of Gromov-Wasserstein Distance
kobayashi31
1
170
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
shunk031
4
1.1k
セマンティック通信勉強会 6Gに向けたデバイス間効率的な通信の技術紹介・課題・今後展望
satai
3
230
(SIGQS17) Frasco-VS:フラグメントに基づく薬剤候補化合物選抜の量子アニーリングによる実現
keisukeyanagisawa
PRO
0
170
[CV勉強会@関東 CVPR2026] PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow / kantocv 67th CVPR 2026
shunk031
0
180
AIで最適化を解けるか?
mickey_kubo
0
140
多様なデータを許容し学習し続ける模倣学習 / Advanced Imitation Learning for VLA
prinlab
0
250
Featured
See All Featured
The innovator’s Mindset - Leading Through an Era of Exponential Change - McGill University 2025
jdejongh
PRO
1
220
Music & Morning Musume
bryan
47
7.3k
Build The Right Thing And Hit Your Dates
maggiecrowley
39
3.3k
Building AI with AI
inesmontani
PRO
1
1.1k
A Modern Web Designer's Workflow
chriscoyier
698
190k
Amusing Abliteration
ianozsvald
1
240
Agile Leadership in an Agile Organization
kimpetersen
PRO
0
190
Fantastic passwords and where to find them - at NoRuKo
philnash
52
3.8k
The Illustrated Guide to Node.js - THAT Conference 2024
reverentgeek
1
410
Learning to Love Humans: Emotional Interface Design
aarron
275
41k
ReactJS: Keep Simple. Everything can be a component!
pedronauck
666
130k
Mozcon NYC 2025: Stop Losing SEO Traffic
samtorres
1
410
Transcript
https://arxiv.org/abs/1908.00821 桂 尚輝 (Katsura Naoki) #7【画像処理 & 機械学習】論文LT会 2019.09.13
どんなもの? 先行研究と比べてどこがすごい? 技術や手法のキモはどこ? どうやって有効かを検証した? 議論はある? 入力画像(RGB)から車線を検出する.
蒸留に追加データやラベルを必要とせず,先行研究である message passing機能を有するSCNNは順伝播に全体の 35%の時間を占めるのに対し,提案手法の推論時間はベー スモデルと同程度で精度の向上を達成. ベーシックな蒸留は,教師モデルを用いて新たなモデルを 学習させるが,提案手法のSelf Attention Distillation(SAD) は,自分自身の深いレイヤーにおけるアテンションマップを 浅いレイヤーの蒸留ラベルに使用. したがって, 教師モデ ル等から得られる追加ラベルが必要なく, モデル自体も大 きくならない. Lane Detectionにおける3つのベンチマーク(TuSimple, BDD100K, CULane)で実験を行い,先行研究との比較や SADに関するablation studyを行い有効性を検証. SADを導入することで各レイヤーのアテンションマップが 良くなった. 細部にこだわるタスクにおいても有効かもしれ ない.
背景&先行研究 (1) 車線が画像に対してスパースであるので学習が難しい問題. (2) また,前に走ってる車によってレーンが見えない,実際のレーンが曖昧に引かれている(視覚情報が弱い),路 面状況が悪いといった時にうまく予測できない問題もある.
(3) 先行研究でSoTAなSCNNはmessage passing(MP)によって精度向上を達成したがMP部分に推論時間の 35%が占められていて計算コストが高い. (4) アプローチ方法としては,セグメンテーションとして解く,セグメンテーションしたのちに点をサンプリングして 多項式に変形,多項式のパラメータを予測する方法があるっぽい (?). この論文はsemantic segmentationで解く
Self Attention Distillation 一つレイヤーの深いアテンションマップを蒸 留に用いる教師ラベルとして使用する. 蒸留に対する損失関数は, L2 Loss
Self Attention Distillation 次ココ!
AT-GEN Bilinear Upsample Spatial Softmax p=2で実験したもの が一番よかったらし い C ×
H × W H × W H’ × W’ H’ × W’
Result (Attention map)
Result (vs Previous work)
Result (vs Deep supervision)
Message Passing (MP) https://arxiv.org/abs/1712.06080 MRF/CRF SCNN 近くのピクセル情報を関連づける
Message Passing (MP) https://arxiv.org/abs/1712.06080 CNNは、細く連続な物体や大きな物体のsemantic情報 に弱いらしく、SCNNでそれを改善できたそう