Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
20230923_Kaggler_meetup_LT_ya9do.pdf
Search
ya9do
September 22, 2023
Research
2.5k
2
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
20230923_Kaggler_meetup_LT_ya9do.pdf
ya9do
September 22, 2023
Other Decks in Research
See All in Research
超効率化への挑戦:1bit LLMの現状と展望
yumaichikawa
0
640
Apache Gravitinoで実現する Icebergカタログ統合とアクセスの一元化
matsumooon
0
480
HackSick vol.7 LT資料【LLMアーキテクチャ入門・事前学習時の躓き所解説】 スパースなAttention・状態空間モデル
rikkabotan7
0
170
VLMの推論を高速化する視覚トークン削減の仕組み
tattaka
2
290
論文紹介:Doc-to-LoRA: Learning to Instantly Internalize Contexts
yukako_nakano
0
150
データサイエンティストの就労意識~2015 → 2026 一般(個人)会員アンケートより
datascientistsociety
PRO
0
730
医療LLMの現在地〜最新研究から社会実装までを考える〜
kento1109
1
1.7k
[BlackHatAsia2026] Hidden Telemetry: Uncovering TraceLogging ETW Providers You're Not Using (Yet)
asuna_jp
1
690
[Fishers] DIVER OSINT CTF 2026 特化AIエージェントハーネスで挑戦するOSINT CTF
analokmaus
0
540
SoftMatcha 2: 1兆語規模コーパスの超高速かつ柔らかい検索
e869120_sub
7
3.8k
The story of RefactoringMiner. Slow research, long-term impact
tsantalis
0
130
MIRU2026 チュートリアル講演2:三次元データ処理の動向
nnchiba
6
4.7k
Featured
See All Featured
Pawsitive SEO: Lessons from My Dog (and Many Mistakes) on Thriving as a Consultant in the Age of AI
davidcarrasco
0
230
Typedesign – Prime Four
hannesfritz
42
3.2k
Beyond borders and beyond the search box: How to win the global "messy middle" with AI-driven SEO
davidcarrasco
3
230
Leading Effective Engineering Teams in the AI Era
addyosmani
9
2.5k
Efficient Content Optimization with Google Search Console & Apps Script
katarinadahlin
PRO
1
840
Put a Button on it: Removing Barriers to Going Fast.
kastner
60
4.6k
How to Create Impact in a Changing Tech Landscape [PerfNow 2023]
tammyeverts
56
3.5k
Gemini Prompt Engineering: Practical Techniques for Tangible AI Outcomes
mfonobong
2
510
Tell your own story through comics
letsgokoyo
1
1.1k
Optimizing for Happiness
mojombo
378
71k
Conquering PDFs: document understanding beyond plain text
inesmontani
PRO
4
3k
How to Grow Your eCommerce with AI & Automation
katarinadahlin
PRO
1
260
Transcript
OSSのコード生成型AutoMLを使って 20件のPlaygroundを全自動で解いてみた 2023年9月23日 © 2023 Fujitsu Limited
自己紹介 ◦名前:近藤康彦 (ya9do) ◦所属:富士通株式会社 人工知能研究所 © 2023 Fujitsu Limited ビットコイン価格予測
2 コンペの解法紹介 「~やってみた」系のLTが好きです https://youtu.be/c1WdEpssND8?t=7256s https://youtu.be/8zPjm9xVWzE?t=2751
◦良い感じの動くコードが早く欲しい はじめに:ベースライン作成って結構大変 3 © 2023 Fujitsu Limited AutoMLで簡単にベースラインを作れないか、やってみた # Team
Score 1 team A 0.12 2 team B 0.23 … … … … … … rf_benchmark.csv 0.56 Leader Board RandomForestも あるけれど、 ◦コード生成型AutoML ◦github.com/sapientml/sapientml
Titanicを例にした、SapientMLの使い方 ◦データセットとタスク設定を与えると、学習と予測を行うコードを生成 © 2023 Fujitsu Limited 4 出力 コード データ
セット タスク 設定 SapientMLの呼び出し Sapient ML 出力例) カテゴリ列の前処理
コンペIDの指定だけで予測提出まで全自動化 (*1) 出力 ユーザー 入力 (*) 前提条件:ChatGPTとKaggle APIの設定、コンペの参加許諾 5 ©
2023 Fujitsu Limited 43.90 コード スコア
コンペIDの指定だけで予測提出まで全自動化 (*1) 出力 ユーザー 入力 (*) 前提条件:ChatGPTとKaggle APIの設定、コンペの参加許諾 6 予測
CSV © 2023 Fujitsu Limited 43.90 コード スコア :Kaggle API、 :Playwright、 :ChatGPT コンペ 情報 実行 ChatGPTで タスクを抽出 Sapient ML コード タスク 設定 データ セット Submit ❶ ❷ ❸
ベースラインとして使えそうか? 7 © 2023 Fujitsu Limited 評価観点 スコア 計算 時間
Public Score コード生成時間 + 生成されたコードの実行時間 比較 対象 - rf_benchmark.csv - (参考) 他参加者の1st submit コンペティション Playground Series3のEpisode 1-20 例) https://www.kaggle.com/competitions/playground-series-s3e20 種類
結果 © 2023 Fujitsu Limited 8 コンペ ティション SapientML スコア順位
rf_benchmark スコア順位 SapientML 計算時間(秒) s3e1 0.607 0.705 33 s3e2 0.283 0.284 6 s3e3 0.34 0.577 8 s3e4 0.624 0.587 103 s3e5 0.522 0.582 4 s3e6 0.234 0.3 21 s3e7 0.332 0.406 9 s3e8 0.636 0.681 109 s3e9 0.782 0.383 6 s3e10 0.509 0.331 103 s3e11 0.758 0.636 180 s3e12 0.726 0.096 4 s3e13 -1 -1 -1 s3e14 0.425 0.356 13 s3e15 -1 -1 -1 s3e16 0.339 0.575 44 s3e17 0.49 0.32 24 s3e18 -1 0.197 -1 s3e19 -1 0.399 -1 s3e20 0.425 0.672 32 ◦20件中16件の自動化に成功 ◦スコアはrf_benchmark.csv と同程度 ◦最大3分でコード生成 ・スコア順位は参加者数で除算し正規化 ・自動化失敗時は-1と記載
スコア比較(1/2) 9 スコア順位 参加者数で順位を除算し0-1に変換 凡例 •:SapientML ▪:rf_benchmark.csv ×:参加者の1st submission ©
2023 Fujitsu Limited ◦順位とスコアの可視化 ◦横軸:左に行くほど優秀 ◦縦軸:コンペ指標によって優劣の方向は異なる スコア
10 © 2023 Fujitsu Limited スコア比較(2/2) 全自動化 失敗 全自動化 失敗
全自動化 失敗 全自動化 失敗 凡例 •:SapientML ▪:rf_benchmark.csv ×:参加者の1st submission
まとめ ◦コード生成型AutoML “SapientML”を使ってPlaygroundを解いてみた ◦3分でrf_benchmark.csvと同程度のスコアを出すコードを生成 ⇒ ベースライン作成に役立つのではないか ◦公開しています ◦GitHub :github.com/sapientml/sapientml ◦お試し環境
:automl.jp.fujitsu.com/ja/page/howtouse 11 © 2023 Fujitsu Limited # Team Score 1 team A 0.12 … … … rf_benchmark.csv 0.56 良い感じの ベースラインに したい! … SapientML 0.54 Leader Board … … …
Thank you © 2023 Fujitsu Limited
© 2023 Fujitsu Limited 13
14 © 2023 Fujitsu Limited スコア比較 w/ 1st sub, w/
AutoGluon 全自動化 失敗 全自動化 失敗 全自動化 失敗 全自動化 失敗 凡例 •:SapientML ▪:rf_benchmark.csv •:AutoGluon ×:参加者の1st submission
15 © 2023 Fujitsu Limited スコア比較 w/ LeaderBoard, w/ AutoGluon
全自動化 失敗 全自動化 失敗 全自動化 失敗 全自動化 失敗 凡例 •:SapientML ▪:rf_benchmark.csv •:AutoGluon ×:LeaderBoard