Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
Agent Skillsを 正しく活用する
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
daichi
March 11, 2026
290
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
Agent Skillsを 正しく活用する
Agent Skillsを
正しく活用する
daichi
March 11, 2026
More Decks by daichi
See All by daichi
ボトルネックは レビューに移った〜開発フローの5工程をチーム標準化した話
daikin555
0
47
元和菓子職人、エンジニアになって5年経ちました。
daikin555
0
100
PostgreSQLのロジカルレプリケーションを利用してみる
daikin555
0
160
データベースエンジニアの仕事と魅力
daikin555
0
91
Featured
See All Featured
Fantastic passwords and where to find them - at NoRuKo
philnash
52
3.8k
Agile Actions for Facilitating Distributed Teams - ADO2019
mkilby
0
280
Fashionably flexible responsive web design (full day workshop)
malarkey
409
67k
職位にかかわらず全員がリーダーシップを発揮するチーム作り / Building a team where everyone can demonstrate leadership regardless of position
madoxten
69
65k
BBQ
matthewcrist
89
10k
Large-scale JavaScript Application Architecture
addyosmani
515
110k
Getting science done with accelerated Python computing platforms
jacobtomlinson
2
480
The SEO identity crisis: Don't let AI make you average
varn
0
560
How to Talk to Developers About Accessibility
jct
2
550
The Psychology of Web Performance [Beyond Tellerrand 2023]
tammyeverts
49
3.6k
Pawsitive SEO: Lessons from My Dog (and Many Mistakes) on Thriving as a Consultant in the Age of AI
davidcarrasco
0
240
Rebuilding a faster, lazier Slack
samanthasiow
85
9.6k
Transcript
AGENT SKILLSを 正しく活用する 「PDFを投げるだけ」では不十分な理由
きっかけ Xでの投稿 「ANTHROPICのSKILLSガイドPDFをCLAUDE CODEに投げて オリジナルのSKILL-CREATORを作ると精度と品質が爆上がりする」 試してみた結果… この情報は半分正しいが、重要な部分が抜けている
コンテキストとは AIエージェントが「一度に処理できる情報量の上限」 コンテキストに含まれるもの • 会話履歴(これまでのやり取り) • システムプロンプト(基本指示) • 読み込んでいるファイルやドキュメント •
ツールの定義情報 • インストール済みのSKILLSの情報 コンテキストが埋まると → 品質が下がる
AGENT SKILLSの仕組み:段階的開示 第1段階(常時ロード) NAME と DESCRIPTION のみ → コンテキスト影響は最小限 第2段階(SKILL起動時のみ)
SKILL.MD の本文 → 関連タスクが来たときだけ読み込み 第3段階(必要に応じて) SCRIPTS / REFERENCES / ASSETS → 必要なものだけ参照 → コンテキスト節約と豊富な専門知識の両立を実現 1 2 3
SKILLの基本構造 フォルダ構成 MY-SKILL/ ├ SKILL.MD ← 必須 ├ SCRIPTS/ 任意
├ REFERENCES/ 任意 └ ASSETS/ 任意 SKILL.MDの構成 --- NAME: MY-SKILL-NAME DESCRIPTION: ... --- # MY SKILL CLAUDEへの指示を記述 ※ DESCRIPTIONが起動判断の鍵
PDFだけでは不十分な理由 PDFがカバーしていない4つの領域 ❶ EVALパイプライン(品質評価の仕組み) PDFは「手動でクエリを試す」程度の記述のみ ❷ サブエージェントによる自動評価 GRADER / COMPARATOR
/ ANALYZER の3エージェント連携 ❸ DESCRIPTIONの「UNDERTRIGGER問題」 CLAUDEはSKILLを使うべき時に使わない傾向がある ❹ DESCRIPTION最適化フロー SHOULD-TRIGGER / SHOULD-NOT-TRIGGER の体系的テスト
公式SKILL-CREATORの強み 充実したテスト・評価サイクル テストケース設計 ↓ 並列実行(WITH_SKILL / WITHOUT_SKILL) ↓ GRADER評価 →
BENCHMARK集計 → HTMLビューアで確認 ↓ ユーザーフィードバック → SKILL改善 → 繰り返し 「動くか確認」ではなく「定量的に比較」できる
公式SKILL-CREATORの構成 フォルダ構成 SKILL-CREATOR/ ├ SKILL.MD ├ AGENTS/ ← NEW │
├ GRADER.MD │ ├ COMPARATOR.MD │ └ ANALYZER.MD ├ EVAL-VIEWER/ ← NEW ├ REFERENCES/ ├ SCRIPTS/ └ ASSETS/ 注目ポイント • AGENTS/ 品質評価の3サブエージェント定義 • EVAL-VIEWER/ 評価結果の可視化ツール • SCRIPTS/ RUN_EVAL.PY IMPROVE_DESCRIPTION.PY AGGREGATE_BENCHMARK.PY PACKAGE_SKILL.PY 「作って終わり」→「測定して改善する」哲学
PDF VS 公式SKILL-CREATOR 観点 PDFのみ 公式skill-creator Skillの概念理解 十分 フォルダ構成・命名規則 十分
MCP連携パターン 詳しい 記載なし undertrigger対策 evalパイプライン 概念のみ 本格的 with/without比較 環境別の挙動の違い
まとめ PDF = 「SKILLを理解するための本」 公式SKILL-CREATOR = 「作り、測定し、改善するためのツール」 両方を組み合わせるのが最も効果的 おすすめ:PDFで概念を学ぶ →
公式SKILL-CREATORで実装する 参考:GITHUB.COM/ANTHROPICS/SKILLS