Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
Search
ayane
July 08, 2026
Technology
34
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
2026年6月18日のGenAIge Cafe #8「
https://genaige.connpass.com/event/396761/
」で話した資料です
ayane
July 08, 2026
More Decks by ayane
See All by ayane
GenAIge Cafe #9 - AIエージェントって何?
blueb
0
29
えっ___まだ生成AIを24時間動かしてないんですか_.pdf
blueb
0
140
GenAIge_cafe__4_1年前のAI_覚えてますか_.pdf
blueb
0
150
GenAIge Cafe #3 : 5分でわかる 最近のAI動向ミニニュース(2025年12月)
blueb
0
32
AGI福岡第8回_NotebookLMの動画解説機能で_この1年を振り返るLT用動画を作ってみた_.pdf
blueb
0
120
GenAI Cafe#2:最近のAI動向情報(5分ミニトーク)
blueb
0
50
AIミートアップ by ayatabi.net vol.2 at CIC Fukuoka
blueb
0
39
第5回_ぬか炊きLT-AI時代の夏の自由研究
blueb
0
77
ChatGPTだけじゃない みんなで楽しむ生成AIの世界
blueb
0
140
Other Decks in Technology
See All in Technology
AmplifyHostingConstructからSSRフレームワークのためのホスティング設計を考察する/amplify-hosting-construct
fossamagna
1
300
書籍セキュアAPIについて
riiimparm
0
240
reFACToring
moznion
0
190
事業成長とAI活用を止めないデータ基盤アーキテクチャの設計思想
hiracky16
0
530
AI時代におけるエンジニアの新たな役割──FDEとクオリアの探求/登壇資料(戸井田 裕貴)
hacobu
PRO
0
320
Playwright × AI Agent でE2Eテストはどう変わるか AI駆動テストの可能性と実用検証の結果
taiga7543
2
800
AI時代におけるテストの基礎の再定義 / Rethinking the Fundamentals of Testing in the AI Era
mineo_matsuya
14
4.5k
複数プロダクトで進めるAI機能実装 ── 実践から得たリアルな学びとロードマップ実現への挑戦 / AICon2026_yanari
rakus_dev
1
270
”AIを使う” から ”AIに任せる” へ ─ 開発プロセスを再設計してAIを組織標準にするまで
cyberagentdevelopers
PRO
1
140
それでも、技術なブログを書く理由 #kichijojipm / Why I Still Write Tech Blogs Even Now
shinkufencer
0
410
Webの技術とガジェットで子どもも大人も楽しめるワクワク体験を提供する / Qiita Tech Festa Day 2026
you
PRO
1
150
現場との対話から始める “作る前に問い直す”業務改善
mochico50
1
220
Featured
See All Featured
Product Roadmaps are Hard
iamctodd
55
12k
Designing for Performance
lara
611
70k
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
133
19k
How Fast Is Fast Enough? [PerfNow 2025]
tammyeverts
3
660
Building AI with AI
inesmontani
PRO
1
1.1k
Agile Leadership in an Agile Organization
kimpetersen
PRO
0
190
GitHub's CSS Performance
jonrohan
1033
470k
Git: the NoSQL Database
bkeepers
PRO
432
67k
Dealing with People You Can't Stand - Big Design 2015
cassininazir
367
27k
Organizational Design Perspectives: An Ontology of Organizational Design Elements
kimpetersen
PRO
1
770
Designing for humans not robots
tammielis
254
26k
Visual Storytelling: How to be a Superhuman Communicator
reverentgeek
2
590
Transcript
ローカル⼤規模⾔語モデル いまどこまで動く? ⼿元のパソコンで⽣成AIを動かすための、 ざっくり現実ライン(2026年6⽉版) 2026年6⽉18⽇ GenAIge Cafe #8 綾祢
まず結論!「動くか」から「快適か」の時代へ ⼩さめモデル 個⼈のパソコンでも現実的に動き ます。「動くかどうか」から「快 適か」を楽しむ時代へ。 カギは「ビデオメモリ」 気持ちよく使うにはグラフィック 処理装置のメモリが重要! 2026年6⽉は24GB〜32GBが実⽤ ラインです。
巨⼤モデルは別世界 とても⼤きなモデルは、個⼈⽤パ ソコンというより⾼性能ワークス テーションやサーバーの世界で す。
「ローカル⼤規模⾔語モデル」とは? インターネットの向こう側(クラウド)ではなく、⼿元のパソコン で直接動かす⽣成AIのことです。 メリット インターネットに繋がっていなくても試せる(場合があ る)。⾃分のデータを外に出さずに遊べる。 注意点 パソコン側に「がんばる⼒」が必要。また、使い⽅次第 で安全性は変わるため「必ず安全」とは限りません。
なぜ「ビデオメモリ」が⼤事なの? 「パソコン本体のメインメモリが24GBあればいい」…というわけ ではありません! ビデオメモリ グラフィック処理装置の専⽤メモリ。 例え:「机の上の作業スペース」(超⾼速!) メインメモリ パソコン本体のメモリ。 例え:「部屋の作業台」(机よりは遅い) ストレージ
保存場所。 例え:「本棚」(しまう場所)
2026年6⽉時点の、現実的な3つの層 モデルの規模 (例え:本の厚さ) ⽬安 必要なビデオメモリ感 初⼼者向けの理解 7B 〜 8B 前後
⼩さめ 6GB〜8GBから動き始める (12GB〜16GBあると安⼼) まず試すならここ! 24B 〜 32B 前後 中くらい 24GB〜32GBが実⽤ライン かなり実⽤的で⾯⽩い 70B 以上 ⼤きい 48GB〜80GB以上など (または複数台の連携が必要) 個⼈の趣味を超え、 ワークステーションやサーバー寄り
⽇本語でゆるく試すなら、この3つ! Qwen 3 系 公式情報で、119の⾔語と⽅⾔を サポート。多⾔語に強いモデルと して世界的に⼈気です。 Gemma 4 系
公式情報で140以上の⾔語をサ ポート。様々なサイズがあり、環 境に合わせて選びやすいです。 Mistral Small 3.2 公式のモデル説明で「⽇本語対 応」を明記。中くらいのサイズ で、バランスの良さが光ります。
どんなパソコンなら楽しめる?(ざっくり⽬安) ※情報を少し圧縮して軽くする「4ビット量⼦化」を⾏った場合の⽬安です。利⽤ソフト等で快適さは変わります。 1 まず試す ⼩さめのモデル(7B〜 8B)を⼿元で動かして みる⼊⾨編。 2 ちゃんと楽しむ ⼩さめモデルは快適。
中くらい(24B前後) も⼯夫次第で試せま す。 3 本格的に遊ぶ Gemma 4 26B A4B QATなど中くらいが視 野に。例: RTX 4090, RTX 5090等 4 別世界‧⼤型 70B以上や、複雑な専 ⾨家連携モデル向け。 例: Radeon PRO W7900等
⼀次情報URL⼀覧 モデル公式‧モデルカード 実⾏環境‧量⼦化 / ハードウェア仕様 Meta Llama 4 公式ブログ https://ai.meta.com/blog/llama-4-multimodal-intelligence/
Llama 3.1 8B Instruct model card https://huggingface.co/meta-llama/Llama-3.1-8B-Instruct Llama 3.3 70B Instruct model card https://huggingface.co/meta-llama/Llama-3.3-70B-Instruct Mistral Small 3.2 24B https://huggingface.co/mistralai/Mistral-Small-3.2-24B-Instruct-2506 Gemma 4 26B A4B https://huggingface.co/google/gemma-4-26B-A4B Gemma 4 26B A4B QAT https://lmstudio.ai/models/google/gemma-4-26b-a4b-qat Qwen 3 公式ブログ https://qwenlm.github.io/blog/qwen3/ Qwen3.6 27B https://huggingface.co/Qwen/Qwen3.6-27B Qwen3 30B-A3B model card https://huggingface.co/Qwen/Qwen3-30B-A3B llama.cpp 公式GitHub https://github.com/ggml-org/llama.cpp vLLM hardware support https://docs.vllm.ai/en/v0.9.2/features/quantization/supported_hardware.html Transformers bitsandbytes docs https://huggingface.co/docs/transformers/quantization/bitsandbytes PyTorch Gemma 3 27B INT4 benchmark https://huggingface.co/pytorch/gemma-3-27b-it-INT4 NVIDIA Llama 3.1 8B ONNX INT4 page https://huggingface.co/nvidia/Meta-Llama-3.1-8B-Instruct-ONNX-INT4 Ollama MLX performance https://ollama.com/blog/mlx-performance NVIDIA GeForce RTX 4090 specs https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4090/ AMD Radeon PRO W7900 specs https://www.amd.com/en/products/graphics/workstations/radeon-pro/w7900.html NVIDIA ⽐較 GeForce グラフィックス カード https://www.nvidia.com/ja-jp/geforce/graphics-cards/compare/