Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
【論文解説】KAN: Kolmogorov-Arnold Networks
Search
tamoharu
June 11, 2024
Research
1.1k
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
【論文解説】KAN: Kolmogorov-Arnold Networks
KANの理論的な解説を簡単にまとめました
tamoharu
June 11, 2024
Other Decks in Research
See All in Research
Ghost in the 7‑Zip: The Shadow of Residential Proxies Creeping into Your Life
nttcom
0
2.1k
RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent
satai
3
530
Cross-Media Information Spaces and Architectures
signer
PRO
0
360
最先端NLP勉強会2026 論文紹介:Reasoning with Sampling: Your Base Model is Smarter Than You Think (ICLR 2026 paper)
kogoro
4
580
最先端NLP 2026 論文紹介: Wait, Wait, Wait... Why Do Reasoning Models Loop? / SNLP Paper Review: Wait, Wait, Wait... Why Do Reasoning Models Loop?
tkng
0
210
IA for theory
gpeyre
1
400
コーディングエージェントとABNを再考
hf149
2
860
シングルチャネルマルチトーカー音声認識の進展
ryomasumura
0
250
Anthropic が提案する LLM の内部状態を自然言語で説明可能にした Natural Language Autoencoders / Natural Language Autoencoders Produce Unsupervised Explanations of LLM Activations
shunk031
0
200
The story of RefactoringMiner. Slow research, long-term impact
tsantalis
0
140
東京大学工学部計数工学科、計数工学特別講義の説明資料
kikuzo
0
650
研究室単位での自律的 IPv6接続性確立に向けたAS共同運用モデルの提案と実証
reokashiwa
PRO
0
210
Featured
See All Featured
Conquering PDFs: document understanding beyond plain text
inesmontani
PRO
4
3k
How to Build an AI Search Optimization Roadmap - Criteria and Steps to Take #SEOIRL
aleyda
1
2.2k
Primal Persuasion: How to Engage the Brain for Learning That Lasts
tmiket
0
440
Done Done
chrislema
186
16k
The Anti-SEO Checklist Checklist. Pubcon Cyber Week
ryanjones
0
230
Testing 201, or: Great Expectations
jmmastey
46
8.3k
Pawsitive SEO: Lessons from My Dog (and Many Mistakes) on Thriving as a Consultant in the Age of AI
davidcarrasco
0
240
Distributed Sagas: A Protocol for Coordinating Microservices
caitiem20
333
23k
Designing Powerful Visuals for Engaging Learning
tmiket
1
530
Building a Modern Day E-commerce SEO Strategy
aleyda
45
9.2k
Facilitating Awesome Meetings
lara
57
7.1k
Leveraging Curiosity to Care for An Aging Population
cassininazir
1
490
Transcript
KAN: Kolmogorov-Arnold Networks ⽥本 晴輝 京都⼤学 理学部 3年
Kolmogorov-Arnold表現定理を背景に、従来の 多層パーセプトロン(MLP)に変わる新たな ニューラルネットワークを提案。 MLPはエッジの線形変換を学習するのに対して、 KANはエッジの⾮線形変換を学習する。 概要 ポイント • 微分⽅程式を解くタスクにおいてMLPに対して 100倍のパラメータ効率を達成
→ 次元の呪いを克服 (?) • ⾮線形変換を学習するため、解釈可能性に 優れる → ブラックボックス化の解消 MLP KAN
ニューラルネットワークとは? 𝒙 𝒚 𝒇 ⼊⼒ 出⼒ NN • ⼊⼒を受け取って出⼒を計算するモデルである。 •
データから“学習”することによって理想的な関数 に近似する → 連続関数を表現できればNNを構築できるのでは? 普遍性定理 Kolmogorov-Arnold表現定理 MLP KAN • 線形変換 𝐰 と特定の⾮線形変換 𝜎 を組み合わせ ることで任意の連続関数を近似できるという定理 • 𝐰 はエッジの線形変換、 𝜎 はノードの活性化関数 に相当 • 1変数連続関数 Φ, 𝜙 の重ね合わせによって任意の 多変数連続関数を完全に表現できるという定理 • Φ, 𝜙 はエッジの⾮線形変換、Σはノードの加算操作 に相当 (従来のNN)
1. 各変数 𝑥! に対してn個の内部関数 𝜙",! 𝑥! を作⽤させる 2. その結果を各 𝑞
について⾜し合わせる 3. 内部関数の和を 2n + 1 個の外部関数 Φ" にそれぞれ⼊⼒ 4. 最後にその結果を全て⾜し合わせる KANの理論 式の⾒⽅ これは2層のKANに相当する Kolmogorov-Arnold表現定理 KANへの拡張 外部関数を多層に重ね合わせることでMLPの強みを取り⼊れることに成功し、表現⼒が⾶躍的に向上した。 1層⽬ 2層⽬ ここが本論⽂の新規性! しかし、実際はあまり上⼿くいかなかった… 2層⽬ 1層⽬ 任意の多変数連続関数は1変数連続関数から構成できる
sin π𝑥 𝑦$ exp • + exp sin π𝑥 +
𝑦$ の学習例 解釈可能性 • 学習後に重要でないノードを刈り 取った結果を描画している。 • 𝑥, 𝑦 の⼊⼒から出⼒までの計算過程 が⾒事に可視化されている。 忘却の回避 • KANはデータを新たに与えても以前 の学習過程が保存されている • MLPでは追加学習によって既存の 情報が書き換えられてしまうが、 KANはその局所性によって遠くの 情報は保持される
まとめ • KANは関数近似タスクにおいてMLPを⼤きく上回る結果を出した • 現実世界のタスクでも上⼿くいくかどうかは検証の余地あり • その他にも、MLPが抱える問題を解決しうる期待感がある