Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
Search
ayane
July 08, 2026
Technology
51
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
2026年6月18日のGenAIge Cafe #8「
https://genaige.connpass.com/event/396761/
」で話した資料です
ayane
July 08, 2026
More Decks by ayane
See All by ayane
Hermes Agentで、AIが調べて記事を書くブログを作った話
blueb
0
61
GenAIge Cafe #10 生成AIとここまで、これから。
blueb
0
43
GenAIge Cafe #9 - AIエージェントって何?
blueb
0
72
えっ!?まだ生成AIを24時間動かしてないんですか?
blueb
0
150
GenAIge cafe 4 :1年前のAI_覚えてますか
blueb
0
160
GenAIge Cafe #3 : 5分でわかる 最近のAI動向ミニニュース(2025年12月)
blueb
0
40
NotebookLMの動画解説機能で_この1年を振り返るLT用動画を作ってみた
blueb
0
240
GenAI Cafe#2:最近のAI動向情報(5分ミニトーク)
blueb
0
54
AIミートアップ by ayatabi.net vol.2 at CIC Fukuoka
blueb
0
48
Other Decks in Technology
See All in Technology
synctest時代のhttptest Go 1.27で変わるHTTPサーバテストの裏側 / go conference2026 synctest and httptest
budougumi0617
1
3k
JSONataとAWS Step Functionsで目指すRuntimelessな世界
mu7889yoon
0
120
GoのInterface内部構造から学ぶ!最高パフォーマンスを出すコード設計
yappli_developers
0
130
銀行勘定系システムにおける開発プロセス刷新×AIによる環境モダナイゼーション / Development Process Transformation and AI-Driven Environment Modernization
muit
1
2.3k
フルカイテン株式会社 エンジニア向け採用資料
fullkaiten
0
12k
ADKで始める業務改善 - AIエージェント開発時の考えと設計
harappa80
2
170
今話題のAI「Jev」って何? 宇宙最速で学ぶ会
minorun365
PRO
27
16k
「ピッケル本」日本語版は4.0(第6版)が出版されるべき / pickaxe4-nagoyark05
kakutani
1
170
10Xに技術的負債をもたらした「2つの境界の歪み」その構造と解消への営み
10xinc
0
2k
Claude Codeを「使うほど育つ」AI秘書にするノウハウ
minorun365
PRO
31
27k
AIエージェントの自己改善をどう設計するか / How to Design Self-Improvement for AI Agents
22mi
25
16k
Goodbye ShellScript, Hello File-based App
shunsock
0
150
Featured
See All Featured
世界の人気アプリ100個を分析して見えたペイウォール設計の心得
akihiro_kokubo
PRO
74
42k
4 Signs Your Business is Dying
shpigford
187
23k
[RailsConf 2023 Opening Keynote] The Magic of Rails
eileencodes
31
10k
Build The Right Thing And Hit Your Dates
maggiecrowley
39
3.4k
How to Create Impact in a Changing Tech Landscape [PerfNow 2023]
tammyeverts
56
3.5k
SEO in 2025: How to Prepare for the Future of Search
ipullrank
3
3.8k
How to make the Groovebox
asonas
2
2.4k
Introduction to Domain-Driven Design and Collaborative software design
baasie
1
990
Unsuck your backbone
ammeep
672
58k
Designing Powerful Visuals for Engaging Learning
tmiket
1
550
GraphQLとの向き合い方2022年版
quramy
50
15k
The Impact of AI in SEO - AI Overviews June 2024 Edition
aleyda
6
1.2k
Transcript
ローカル⼤規模⾔語モデル いまどこまで動く? ⼿元のパソコンで⽣成AIを動かすための、 ざっくり現実ライン(2026年6⽉版) 2026年6⽉18⽇ GenAIge Cafe #8 綾祢
まず結論!「動くか」から「快適か」の時代へ ⼩さめモデル 個⼈のパソコンでも現実的に動き ます。「動くかどうか」から「快 適か」を楽しむ時代へ。 カギは「ビデオメモリ」 気持ちよく使うにはグラフィック 処理装置のメモリが重要! 2026年6⽉は24GB〜32GBが実⽤ ラインです。
巨⼤モデルは別世界 とても⼤きなモデルは、個⼈⽤パ ソコンというより⾼性能ワークス テーションやサーバーの世界で す。
「ローカル⼤規模⾔語モデル」とは? インターネットの向こう側(クラウド)ではなく、⼿元のパソコン で直接動かす⽣成AIのことです。 メリット インターネットに繋がっていなくても試せる(場合があ る)。⾃分のデータを外に出さずに遊べる。 注意点 パソコン側に「がんばる⼒」が必要。また、使い⽅次第 で安全性は変わるため「必ず安全」とは限りません。
なぜ「ビデオメモリ」が⼤事なの? 「パソコン本体のメインメモリが24GBあればいい」…というわけ ではありません! ビデオメモリ グラフィック処理装置の専⽤メモリ。 例え:「机の上の作業スペース」(超⾼速!) メインメモリ パソコン本体のメモリ。 例え:「部屋の作業台」(机よりは遅い) ストレージ
保存場所。 例え:「本棚」(しまう場所)
2026年6⽉時点の、現実的な3つの層 モデルの規模 (例え:本の厚さ) ⽬安 必要なビデオメモリ感 初⼼者向けの理解 7B 〜 8B 前後
⼩さめ 6GB〜8GBから動き始める (12GB〜16GBあると安⼼) まず試すならここ! 24B 〜 32B 前後 中くらい 24GB〜32GBが実⽤ライン かなり実⽤的で⾯⽩い 70B 以上 ⼤きい 48GB〜80GB以上など (または複数台の連携が必要) 個⼈の趣味を超え、 ワークステーションやサーバー寄り
⽇本語でゆるく試すなら、この3つ! Qwen 3 系 公式情報で、119の⾔語と⽅⾔を サポート。多⾔語に強いモデルと して世界的に⼈気です。 Gemma 4 系
公式情報で140以上の⾔語をサ ポート。様々なサイズがあり、環 境に合わせて選びやすいです。 Mistral Small 3.2 公式のモデル説明で「⽇本語対 応」を明記。中くらいのサイズ で、バランスの良さが光ります。
どんなパソコンなら楽しめる?(ざっくり⽬安) ※情報を少し圧縮して軽くする「4ビット量⼦化」を⾏った場合の⽬安です。利⽤ソフト等で快適さは変わります。 1 まず試す ⼩さめのモデル(7B〜 8B)を⼿元で動かして みる⼊⾨編。 2 ちゃんと楽しむ ⼩さめモデルは快適。
中くらい(24B前後) も⼯夫次第で試せま す。 3 本格的に遊ぶ Gemma 4 26B A4B QATなど中くらいが視 野に。例: RTX 4090, RTX 5090等 4 別世界‧⼤型 70B以上や、複雑な専 ⾨家連携モデル向け。 例: Radeon PRO W7900等
⼀次情報URL⼀覧 モデル公式‧モデルカード 実⾏環境‧量⼦化 / ハードウェア仕様 Meta Llama 4 公式ブログ https://ai.meta.com/blog/llama-4-multimodal-intelligence/
Llama 3.1 8B Instruct model card https://huggingface.co/meta-llama/Llama-3.1-8B-Instruct Llama 3.3 70B Instruct model card https://huggingface.co/meta-llama/Llama-3.3-70B-Instruct Mistral Small 3.2 24B https://huggingface.co/mistralai/Mistral-Small-3.2-24B-Instruct-2506 Gemma 4 26B A4B https://huggingface.co/google/gemma-4-26B-A4B Gemma 4 26B A4B QAT https://lmstudio.ai/models/google/gemma-4-26b-a4b-qat Qwen 3 公式ブログ https://qwenlm.github.io/blog/qwen3/ Qwen3.6 27B https://huggingface.co/Qwen/Qwen3.6-27B Qwen3 30B-A3B model card https://huggingface.co/Qwen/Qwen3-30B-A3B llama.cpp 公式GitHub https://github.com/ggml-org/llama.cpp vLLM hardware support https://docs.vllm.ai/en/v0.9.2/features/quantization/supported_hardware.html Transformers bitsandbytes docs https://huggingface.co/docs/transformers/quantization/bitsandbytes PyTorch Gemma 3 27B INT4 benchmark https://huggingface.co/pytorch/gemma-3-27b-it-INT4 NVIDIA Llama 3.1 8B ONNX INT4 page https://huggingface.co/nvidia/Meta-Llama-3.1-8B-Instruct-ONNX-INT4 Ollama MLX performance https://ollama.com/blog/mlx-performance NVIDIA GeForce RTX 4090 specs https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4090/ AMD Radeon PRO W7900 specs https://www.amd.com/en/products/graphics/workstations/radeon-pro/w7900.html NVIDIA ⽐較 GeForce グラフィックス カード https://www.nvidia.com/ja-jp/geforce/graphics-cards/compare/