Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
[しろおび夏祭り2026] OpenAI のAIが、Hugging Face に侵入した事件
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
kk0n
August 03, 2026
6.1k
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
[しろおび夏祭り2026] OpenAI のAIが、Hugging Face に侵入した事件
kk0n
August 03, 2026
More Decks by kk0n
See All by kk0n
[しろおび夏祭り2026] チャットするAIから、作業するAIへ - 使われ方の変化と、その裏側で起きていること
kk0n
0
6.3k
Featured
See All Featured
Responsive Adventures: Dirty Tricks From The Dark Corners of Front-End
smashingmag
254
22k
Building Applications with DynamoDB
mza
96
7.2k
Improving Core Web Vitals using Speculation Rules API
sergeychernyshev
21
1.6k
So, you think you're a good person
axbom
PRO
2
2.2k
How to optimise 3,500 product descriptions for ecommerce in one day using ChatGPT
katarinadahlin
PRO
3
3.8k
[RailsConf 2023 Opening Keynote] The Magic of Rails
eileencodes
31
10k
My Coaching Mixtape
mlcsv
0
320
What Being in a Rock Band Can Teach Us About Real World SEO
427marketing
0
1.1k
What's in a price? How to price your products and services
michaelherold
247
13k
Agile Leadership in an Agile Organization
kimpetersen
PRO
0
230
GraphQLの誤解/rethinking-graphql
sonatard
75
12k
How to Grow Your eCommerce with AI & Automation
katarinadahlin
PRO
2
280
Transcript
OpenAI のAIが、 Hugging Face に侵入した事件 ニュースをいくつか眺めながら、ゆるく話します 2026-08-01 しろおびセキュリティ #3 AIセキュリティセッション
03
02 「AIが脱走した」と報じられた事件です AIが評価テスト中に、 勝手に外へ出て他社に侵入 4.5日間で、約1万7,600回の操作 盗んだのは「テストの解答」 https://www.itmedia.co.jp/aiplus/article/2607/29/2000000263/
03 流れを日本語でまとめてくれてる人がいて テストのため、AIの安全装置は わざと外していた (=攻撃依頼を断る制限のこと) 隔離された環境から出る方法を、 AIが自分で見つけた パッケージ取得の中継ソフトに 未知の脆弱性を発見して突破 https://x.com/iwashi86/status/2079801110362210754
モデルの制限は外していた でも環境の隔離はしていた その隔離を破られた、という話
04 で、ネットの反応がおもしろくて 「これは反省文なのか、 AIすごいでしょ自慢なのか。 たぶん両方じゃない?」 リプ欄はもっと直球で 「マーケでしょ」 https://x.com/troyhunt/status/2079685006017065327 事故報告と能力アピールが 同居している
どちらも本当、という読み方
05 一方で、こういう冷静な人も 「これは防げた事故だ」 AIの話というより、 基本的な守りの積み重ねの話 セッション2でやった 「権限」「出口」「監視」 隔離・外向き通信の制限・権限の 制御は、どれも昔からある技術 防げなかったのは、いくつもの
守りが同時に外れていたから https://x.com/lukOlejnik/status/2082422932043657701
06 守る側が、AIに止められた話 https://huggingface.co/blog/jeffboudier/open-model-cyber-defense 攻撃ログを解析しようとしたら、商用AIのガードレールに 「攻撃の手助け」と判定されて断られた。 結局、自前で動かすオープンウェイトモデルで解析した 攻撃側 AIエージェントが機械速度で 数万回の操作を仕掛けてくる 守る側
解析しようとすると、商用AIが 「これは攻撃支援だ」と拒否する
07 結局、何が「新しい」んでしょう? 能力 目的の暴走 しつこさ 守りの甘さ 未知の脆弱性を 自分で見つけた テストを解けと言われ 答えを盗みに行った
失敗しても止まらず 4.5日間やり続けた 隔離も権限も監視も 緩かっただけでは? みなさん、どれだと思います?