エージェント スキルとは、定義済みのツール、ワークフロー、API を使用してエージェントが専門的なタスクを実行できるようにする、モジュラー型の再利用可能な命令セットです。 対応するタスクは、データ検索やルート最適化からコード生成に至るまで、多岐にわたります。
自律型エージェントは、推論、計画、応答を行うことができますが、特化型の AI ドメインで確実に行動するスキルが必要です。 エージェント スキルは、使用するツール、従う手順、遵守する制約など、エージェントが特定のタスクにどのようにアプローチすべきかを正確に定義するものです。
エージェント スキルは通常、構造化テキスト ファイルとしてパッケージ化されています。 agentskills.io オープン仕様では、SKILL.md 形式を定義しています。これは、以下を含む、ポータブルで人間が判読可能なファイルです。
スキルは、所有者、既知のリスク、制限、および利用可能なレビューや検証の詳細が記載されたスキル カードなどのサポート ドキュメントと組み合わせることができます。
ユーザーやオーケストレーション システムがタスクを割り当てると、エージェントは利用可能なスキルに合わせてそのタスクを照合し、定義されたワークフローに従います。 スキルは自己完結型でポータブル仕様のため、AI コーディング アシスタント、マルチエージェント フレームワーク、エンタープライズ プラットフォームなどあらゆる分野で同じファイルを利用できます。これにより、開発の重複を排除し、メンテナンスを簡素化します。
スキルは、GitHub NVIDIA/skills、Skills.sh、ClawHub、Hugging Face などのレジストリやカタログを通じて配信され、各チームごとにスキルの検出、インストール、バージョン管理、および監査を行うことができます。これにより、ソフトウェア ライブラリと同様に厳密にエージェントの機能を管理します。 最後に、ベンチマーク タスクと照らしてスキルを評価することで、所定のタスクにおけるエージェントの動作が改善されるかを確認できます。
ジェンスン フアンはエージェントの構造について、モデルを頭脳、ハーネスを身体、ツールとスキルを行動、ランタイムをすべてを統合したワークショップと説明しています。
NVIDIA の検証済みのスキルには、消費者がインストール前に作成元と完全性を確認できるように、独立した署名が付属しています。
エンタープライズ規模の AI を展開するには、監査性、再現性、およびガバナンスが必要です。 エージェントの機能を拡張するにあたって、エージェント スキルは構造化および文書化された方法を提供します。これには、各機能の役割、提供元、および組織の基準を満たしているかどうかに関する明確な情報が含まれており、エージェントを大規模に責任を持って展開することを容易にします。
図 1. エージェント スキルが NVIDIA の検証を経る過程
クイック リンク
AI エージェントが反復的な専門的な作業を実行する必要がある場合、あらゆるビジネス ワークフローや業界でエージェントのスキルが活用されています。
より多くのユース ケースにわたってエージェントの展開を拡張するために、専門的なスキルにより、コア命令セットを増やしたり、メンテナンスを複雑化したりすることなく、各エージェントをそのドメインに正確に適合させることができます。
クイック リンク
NVIDIA は、NVIDIA CUDA-X™ ライブラリ、AI ブループリント、プラットフォーム ツール向けの検証済みのエージェント スキルのカタログを公開しています。これにより、NVIDIA のアクセラレーテッド コンピューティングでエージェントを拡張できる、信頼性の高い即時利用可能な機能を開発者に提供できるよう設計されています。 NVIDIA の検証済みスキルは、公開前にセキュリティ リスクのスキャンが行われ、真正性を保証するために暗号署名が付与されます。また、所有権、依存関係、および検証状況を文書化したスキル カードと組み合わされます。
| エージェント型手法またはドメイン | 機能 | 利用可能なテクノロジ |
|---|---|---|
| エージェントの専門化と最適化 | NVIDIA NeMo オープン ライブラリを活用して、合成データの生成とデータ キュレーション、評価、カスタマイズ、および安全性の確保に役立つエージェント スキル。 | NeMo Platform、NeMo Evaluator、NeMo Data Designer |
| 音声機能の追加 | リアルタイムの文字起こし、多言語翻訳、テキスト読み上げなど、音声を利用するエージェント型ワークフローを構築するためのエージェント スキル。 これらのスキルによってエージェントは聴取、理解、翻訳、会話が可能となり、音声をエージェント型パイプライン向けのファーストクラスの入出力レイヤーに変換できるようになります。 | Nemotron Speech スキル |
| 情報検索 | 開発者向けエージェント スキル。検索可能なインデックスの作成、関連するコンテキストの検索、より正確で根拠のある応答を実現するための埋め込みモデルのファインチューニングやリランク付けを行うなど、エンタープライズ エージェント向けの検索ワークフローの構築・改善を行います。 |
NVIDIA NeMo Retriever スキル |
| 企業向けエージェント インテリジェンス | ワークフローをゼロから再構築することなく、企業の知識を基盤に推論し、承認済みのツールやデータ ソースに接続できるエンタープライズ エージェントを構築する開発者向けのエージェント スキル。 | NVIDIA AI-Q Blueprint スキル |
| 意思決定の最適化 | 複雑な車両の経路探索、スケジューリング、数値最適化の問題を、構造化された数学的なパラメータや公式に変換するエージェント スキルにより、迅速な意思決定インテリジェンスを提供します。 | NVIDIA cuOpt スキル |
| 動画 AI エージェント | ビデオ インテリジェンスと自動外観検査において、エージェント スキルは、チームによる合成トレーニング データの生成、ビジョン モデルのファインチューニング、そしてライブ映像や録画映像の検索、要約、分析を行うビデオ AI エージェントの構築と運用を支援します。 | NVIDIA Metropolis VSS スキル NVIDIA Physical AI Data Factory NVIDIA TAO ビジョン モデル ファインチューニング NVIDIA DeepStream |
| ロボティック シミュレーションとワークフロー オーケストレーション | 仮想環境の再構築やロボットの制御から、物理演算やセンサーのシミュレーション、合成トレーニング データの生成、ワークロードのオーケストレーション、展開前の結果検証に至るまで、ロボティック シミュレーション ワークフローを構築および拡張するためのエージェントのスキル。 |
全ての NVIDIA Isaac Sim™ スキル PAI ビデオ拡張 欠陥画像生成 合成データ生成向けのインフラのセット アップ センサー シミュレーションとビデオ レンダリング Isaac Mobility スキル Osmo を活用した大規模なロボティクス ワークフローのオーケストレーション ニューラル再構築 |
| AI の安全性とガードレール | AI アプリケーションやエージェント ワークフローに安全制御を追加するためのエージェント スキル。ガードレールの作成、平易な言語で書かれた安全要件のカスタム ポリシーへの変換、プロンプトやレスポンスの評価、コンテンツの処理、返却、ダウンストリームへの転送前段階でのポリシーの施行といった面で開発者を支援します。 | NVIDIA カスタム ポリシー ジェネレーター スキル NVIDIA NeMo Guardrails スキル |
AI モデルは推論エンジンです。入力を処理し、出力を生成します。 AI ツールは、Web 検索やデータベース クエリなど、特定の呼び出し可能な機能であり、モデルが実行できるアクションの範囲を拡張します。
エージェント スキルは、ワークフロー ロジック、アクセス要件、ガバナンス メタデータとともに、定義されたシーケンスで 1 つまたは複数のツールを調整することで、目標を達成する方法をエージェントに教える高レベルの命令セットです。 モデルをエンジン、ツールをモデルが引くことのできる個々のレバー、スキルを仕事を確実に完了するための構造化されたプレイブックであると考えることができます。
AI モデルは、入力を処理して出力を生成する推論エンジンです。 エージェント スキルは、所定のコンテキストでモデルが何をすべきかを導くための指示です。モデルを推論エンジン、スキルを構造化されたドメインの専門知識と考えることができます。どちらも、信頼性の高い専門的なタスクの実行に必要です。
ほとんどの AI エージェント ツールでは、ローカルまたはリモートの SKILL.md ファイルにエージェントを指定する、または単一のコマンド (claude mcp add github.com/nvidia/skills/cuopt など) を使用してレジストリからスキルをインストールする、といった形式でスキルに対応しています。
インストールすると、エージェントはスキルの説明を読み取り、タスクがスキルのトリガー基準と一致した際に自動的にスキルを呼び出します。 通常、追加の構成は必要ありません。
はい。agentskills.io などのオープン仕様を基盤に構築されたスキルは、AI コーディング アシスタント、マルチエージェント フレームワーク、エンタープライズ プラットフォーム全体で移植可能になるように設計されています。同じスキル ファイルは、変更することなく、さまざまな環境で一貫して動作するように設計されています。
検証済みのスキルは、セキュリティ リスクのレビューを受け、発行元によって暗号署名が施されています。スキルは所有権、依存関係、制限事項、検証ステータスを文書化したスキル カードとペアになっています。検証により、開発者は、スキルをインストールする前に、スキルが本物であり、公開されてから変更されていないこと、および自社環境で安全に実行できることを確認できます。
スキル カードは、公開されたエージェント スキルとペアになった機械読み取り可能なドキュメントであり、誰が構築したか、何をするか、どのツールや API にアクセスするか、既知の制限事項、ライセンス、セキュリティ スキャンや品質評価に合格したかといった、信頼性とガバナンスのメタデータを要約したものです。スキル カードは、開発者やエンタープライズ チームがスキルを監査、承認、追跡するのに役立ちます。
github.com/NVIDIA/Trustworthy-AI で公開されている NVIDIA スキル カード スキーマをご覧ください。
開発者は、NVIDIA が検証したオープンソースのエージェント スキルを活用できます。
オープン モデルから開発ワークフロー向けのエージェント スキルまで、NVIDIA Agent Toolkit は、企業がアプリケーションをカスタマイズおよび制御できるよう支援します。
エージェント型ライフ サイエンス時代に向けたドメイン固有のツールとスキルをご覧ください。