Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
[論文紹介] Chip Placement with Deep Reinforcement Learning
Search
tt1717
April 29, 2024
Research
0
6
[論文紹介] Chip Placement with Deep Reinforcement Learning
PDFファイルをダウンロードすると,スライド内のリンクを見ることができます.
tt1717
April 29, 2024
Tweet
Share
More Decks by tt1717
See All by tt1717
[論文紹介] RT-1: Robotics Transformer for Real-World Control at Scale
tt1717
0
12
[論文紹介] Human-level control through deep reinforcement learning
tt1717
0
12
[論文紹介] Transformer-based World Models Are Happy With 100k Interactions
tt1717
0
33
[論文紹介] Deep Learning for Video Game Playing
tt1717
0
21
[論文紹介] Playing Atari with Deep Reinforcement Learning
tt1717
0
15
[論文紹介] 物理パラメータのランダム化による耐故障ロボットのための強化学習
tt1717
0
20
[論文紹介] 状態遷移差分の学習による耐故障ロボットのための強化学習
tt1717
0
20
[論文サーベイ] Survey on Minecraft AI
tt1717
0
33
[論文サーベイ] Survey on Sim-to-Real
tt1717
0
15
Other Decks in Research
See All in Research
[KDD2023論文読み会] BERT4CTR: An Efficient Framework to Combine Pre-trained Language Model with Non-textual Features for CTR Prediction / KDD2023 LY Tech Reading
shunk031
0
480
データで診て考える合志市の渋滞と公共交通 ~めざせ 車1割削減、渋滞半減、公共交通2倍~
trafficbrain
0
490
訓練データ作成のためのCloudCompareを利用した点群の手動ラベリング
kentaitakura
0
590
Prompt Tuning から Fine Tuning への移行時期推定
icoxfog417
17
7.3k
Engineering LaCAM∗: Towards Real-Time, Large-Scale, and Near-Optimal Multi-Agent Pathfinding
kei18
0
110
Gmail の「メール送信者のガイドライン」強化から 1 ヵ月、今後予想されるメールセキュリティの変化とは
hirachan
1
260
20240209 データを肴に熊本の交通を考える会「車1割削減、渋滞半減、公共交通2倍」をめざし世界に学ぼう
trafficbrain
0
940
Refactoring Mining - The key to unlock software evolution
tsantalis
0
300
Source Code Diff Revolution (JetBrains Open Reading Club)
tsantalis
0
310
眠眠ガチャ:ガチャを活用した睡眠意欲向上アプリの開発 / EC71inui
yumulab
1
200
Evolutionary Optimization ofModel Merging Recipes (2024/04/17, NLPコロキウム)
iwiwi
9
3.9k
SANER 2019 Most Influential Paper Talk
tsantalis
1
130
Featured
See All Featured
Infographics Made Easy
chrislema
238
18k
A better future with KSS
kneath
231
16k
Agile that works and the tools we love
rasmusluckow
325
20k
Imperfection Machines: The Place of Print at Facebook
scottboms
261
12k
Mobile First: as difficult as doing things right
swwweet
217
8.6k
I Don’t Have Time: Getting Over the Fear to Launch Your Podcast
jcasabona
23
1.7k
Fashionably flexible responsive web design (full day workshop)
malarkey
398
65k
Designing Experiences People Love
moore
136
23k
It's Worth the Effort
3n
180
27k
How to name files
jennybc
65
93k
Code Review Best Practice
trishagee
56
15k
Large-scale JavaScript Application Architecture
addyosmani
504
110k
Transcript
・チップの各コンポーネントを構成要素のグラフとして表現し,こ のグラフを効率的にチップのキャンバス上に配置する方策ネット ワークを訓練する. ・従来のチップ配置では多くが人間の専門家の介入を必要としてい た. ・提案した学習ベース手法では経験を積むことで性能が向上し,新 しいチップ配置を高速に生成できる. ・チップ配置を強化学習問題として扱う新たなアプローチを提案. ・提案手法では過去のチップ配置経験から学習し,未知のチップブ ロックに対して最適化された配置を高速に生成する能力があること
を示した. どんなもの? 先行研究と比べて何がすごい? 技術の手法や肝は? どうやって有効だと検証した? ・実際のAIアクセラレータチップ(Google TPUなど)に対して提案 手法を用いてチップ配置を行い,既存のベースライン(人間の専門 家の配置や他の自動配置ツール)と比較することで検証した. ・配置後のPPA(パワー,パフォーマンス,面積)の最適化を評価し た. Chip Placement with Deep Reinforcement Learning (arXiv 2020) Azalia Mirhoseini et al., Google Research. https://arxiv.org/abs/2004.10746 2024/04/28 論文を表す画像 被引用数:224 1/7
❖ 強化学習エージェントがマクロを一つずつ配置する様子を示す ❖ すべてのマクロ配置後,部品は力学的方法(力指向メソッド)を用い て配置される ➢ 力指向メソッド:互いに関連する部品は近くに配置され,関係のない部品 は離れた場所に配置されるようにすること ❖ 報酬はワイヤ長と輻輳の組み合わせで計算され,エージェントが次の
イテレーションでそのパラメータを最適化するために使用する ➢ ワイヤ長:チップの上で部品をつなぐワイヤの長さを推測する方法 ➢ 輻輳:あるエリア内に多くのワイヤが集中してしまう状態 提案手法 2/7
❖ 電子回路の構成要素 (ネットリスト) をGNNで処理 ❖ エッジ埋め込みの処理 ➢ ネットリスト内の異なるコンポーネント間の接続の強さや特性を表現 ❖ マクロ埋め込みの処理
➢ マクロ(大きな回路要素)の特性をベクトル形式で表現 ❖ 方策ネットワークによる処理 ➢ ネットリストの情報を基に,各マクロの配置における「行動」を選択する 提案手法 3/7
❖ CPUのチップ配置結果を視覚化したもの ➢ 左:事前学習済みの方策ネットワークによるゼロショット配置 ➢ 右:ファインチューニング後の方策ネットワークによる配置 ❖ ファインチューニング後の結果は配置が綺麗に揃っている 実験結果 4/7
❖ 強化学習とSA (焼きなまし法) によるサンプル効率の比較 ❖ ワイヤ長 (Wirelength) と輻輳 (Congestion)は低い方が良い ❖
強化学習を使用した提案手法がSAと比較して最適な配置をしていると 解釈できる 実験結果 5/7
❖ 強化学習を使用したチップ配置の最適化手法を提案した ❖ SA (焼きなまし法) と比較して最適配置を達成した まとめ 6/7
❖ チップにおける最適配置問題を強化学習で解こうとするアイデアが面 白かった ❖ 報酬設計の部分や実装コードがどのようになっているのか理解したい 感想 7/7