Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
ライセンスの呪いを祓う
Search
Henry Cui
December 31, 2022
Technology
740
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
ライセンスの呪いを祓う
Henry Cui
December 31, 2022
More Decks by Henry Cui
See All by Henry Cui
プロダクション言語モデルの情報を盗む攻撃 / Stealing Part of a Production Language Model
zchenry
1
260
Direct Preference Optimization
zchenry
0
480
Diffusion Model with Perceptual Loss
zchenry
0
540
レンズの下のLLM / LLM under the Lens
zchenry
0
250
Go with the Prompt Flow
zchenry
0
260
Mojo Dojo
zchenry
0
280
ことのはの力で画像の異常検知 / Anomaly Detection by Language
zchenry
0
760
驚愕の事実!LangChainが抱える問題 / Problems of LangChain
zchenry
0
340
MLOps初心者がMLflowを触る / MLflow Brief Introduction
zchenry
0
230
Other Decks in Technology
See All in Technology
Von-Neumann Machines, Dreams & The Futures of IT
ufried
0
120
AIで社員の自主発信に広報目線を組み込む
_mossann_t
0
140
人間はどの意思決定を手放せるのか
kawasima
15
7.9k
アプリをもっと"iOSアプリっぽく"する小さな工夫 / Small Touches That Make Your App Feel More Like an iOS App
matsuji
2
1k
今話題のAI「Jev」って何? 宇宙最速で学ぶ会
minorun365
PRO
30
18k
作って終わりじゃないサーバーレス 〜9年運用する大規模EC物流API基盤の設計・運用のリアル〜
zozotech
PRO
0
430
「どのログを見ればいい?」 から始めた サーバーレス障害解析
y_waka1
1
120
AIによるクリエイティブ生成を行う上での試行錯誤
plaidtech
PRO
0
170
2026-09-18 gotanda.sre Terraformで複数環境作ったり、複数Stateに分割したりそれとTerragrunt / Terraform multi envs and multi states
masasuzu
4
690
その Lambda、8分で 管理者権限まで奪われます
k1nakayama
7
3.5k
Goodbye ShellScript, Hello File-based App
shunsock
0
630
GoのInterface内部構造から学ぶ!最高パフォーマンスを出すコード設計
yappli_developers
1
250
Featured
See All Featured
The Curious Case for Waylosing
cassininazir
1
520
Raft: Consensus for Rubyists
vanstee
142
7.7k
Designing Experiences People Love
moore
143
24k
Sam Torres - BigQuery for SEOs
techseoconnect
PRO
0
540
Statistics for Hackers
jakevdp
799
230k
The Pragmatic Product Professional
lauravandoore
37
7.4k
Navigating the Design Leadership Dip - Product Design Week Design Leaders+ Conference 2024
apolaine
2
430
Done Done
chrislema
186
17k
Designing for Performance
lara
611
70k
Applied NLP in the Age of Generative AI
inesmontani
PRO
4
2.5k
BBQ
matthewcrist
89
10k
技術選定の審美眼(2025年版) / Understanding the Spiral of Technologies 2025 edition
twada
PRO
120
120k
Transcript
ライセンスの呪いを祓う 機械学習の社会実装勉強会第18回 Henry 2022/12/31
ライセンス! ▪ このライブラリー・この実装を使いたい! → ライセンスを見てみたら、だめでした。。。 ▪ 色々回避策を施し、やっとリリースできる → と思いきや、pre-trained modelをfine
tuningしていた ▪ ほとんどのpre-trained modelはImageNetで学習していた • ImageNetやPlaces365自体は商用不可 • 学習済みモデルの重みという数値の塊は、ImageNetと違うけど、商用 不可と承認したうえでデータをダウンロードし学習を回すので、やはり 学習済みモデルも商用不可なのでは → そもそも最初でImageNetでpre-trainしなければ厄介なことにならな い → ImageNet以外のpre-training data候補として、人工生成画像が有 望! 2
Pre-training without Natural Images ▪ ACCV 2020, IJCV 2022 ▪
数学的に大量な画像を生成したい • Fractalは有名な数学的構造 • シンプルなパラメータで複雑な模様を制御できる ▪ Iterated Function System (IFS)で生成プロセスを定義 • • 一つのIFSを一つの分類カテゴリにする • 確率pでiを決める • 以下の式でxを変換 3
Pre-training without Natural Images ▪ Downstream taskにおいて、scratchを遥かに超える収束速 度を達成 4
実験結果 ▪ 基本的にデータ数(カテゴリ数または各カテゴリの画像数)は 多いほうが性能が良い ▪ ResNet-50という小さめのモデルを使ったので、キャパシティ のより大きいモデルで更に精度向上の可能性 5
実験結果 ▪ ImageNetと拮抗するぐらいの性能 ▪ 人工データに数の上限がないので、モデルのキャパシティを 上げることで性能向上の可能性 6
Can Vision Transformers Learn without Natural Images? ▪ AAAI 2022
▪ 前述の生成過程を少し拡張し、Vision Transformersに適用し た ▪ より性能の良いpre-trainが達成できた 7
Replacing Labeled Real-Image Datasets with Auto-Generated Contours ▪ CVPR 2022
▪ 生成プロセスがより精緻化になったContourベースの人工 データで、Vision Transformersのpre-trainで(限定的ですが) ImageNetを超えた 8
Replacing Labeled Real-Image Datasets with Auto-Generated Contours ▪ Vision TransformerのAttention
Mapで、Fractalsにとって縁 のところが注目される → Contourで良い ▪ 自由度が高い人工データのほうが性能が良い → 生成プロセ スにある可動パラメータを増やせば良い 9
まとめ ▪ ライセンス問題回避のために、人工生成画像で画像認識モデ ルをpre-trainする手法に関する論文 • Vision Transformersで優れた性能が実現 ▪ Future work
• ほとんど白黒の画像を扱ってきたが、カラフルな生成画像でpre-train すればよりパワフルになる! 10