Hermes Agentの「エージェントプロファイル」が重要な理由|92点 vs 27点の実証比較
「Hermes Agentって、設定次第で全然性能が違うらしい」——こういう話を聞くけど、具体的にどこがどう影響するのか、数字で示した検証結果があります。
本日紹介する動画は、「10分間セミナー」チャンネルで公開された実証レポートです。「タダシ」という名前のエージェントプロファイルと、新規に作った「エンジニア」プロファイルを比較したところ、総合スコアで92点 vs 27点という圧倒的な差が出ました。
なぜこんな差が出たのか
結論から言うと、「エージェントソウルの厚み」が原因です。エージェントソウルとは、AIの人格・スタンス・行動原則を定義する設定ファイル(SOUL.md)のこと。これが2,500文字あるかないかで、AIの振る舞いがまるで変わります。
| 項目 | タダシ(92点) | エンジニア(27点) |
|---|---|---|
| エージェントソウル | 2,500文字 | 344文字(デフォルト) |
| ドメインスキル | 69個 | 45個 |
| プロジェクト固有スキル | 15個 | 0個 |
| ユーザーメモリー | 5,000字以上 | 0字 |
| モデル | Gemini 2.5 Flash | DeepSeek 5.5(高性能) |
面白いのは、エンジニアの方が高性能なモデル(DeepSeek 5.5)を使っているのに、タダシ(Gemini 2.5 Flash)の方が仕事ができるという逆転現象が起きている点です。
人とAIは鏡のようなもの
動画では、この状況を「人材採用」に例えて説明しています。
偏差値の高い大学を出た中途入社社員(エンジニアプロファイル)が、実は文脈が読めず、忖度も効かず、「これやっておいて」と言っても全然違うことを始める。一方、中堅どころの大学出身でも、新卒から育ててきたプロパー社員(タダシ)は、背景を理解し、忖度も高く、「こういうこと分かるよね」と言えばちゃんとやってくれる。
「優秀なモデルを入れればAIは使える」わけではない。コンテキスト(文脈・背景・好み)を理解しているかどうかが、実際の性能を決める。これは人もAIも同じです。
エージェントプロファイルの4層構造
Hermes Agentの性能を決める要素は、大きく分けて4つあります。
- 人格定義(SOUL.md):スタンス・行動原則・ハードライン。ここが最も重要
- ドメインスキル:特定のタスクをこなすための手順書
- プロジェクト固有スキル:個別プロジェクト専用の設定
- ユーザーメモリー:好み・進行状況・管理情報
このうち、スキルやドメイン知識は流用できます。しかし人格定義とユーザーメモリーは、そのエージェント固有のもの。ここを育てないと、本当の「パートナー」にはなりません。
結論:魂を入れなければ、エージェントは動かない
動画の結論は明確です。「SOULがなければ、エージェントは思ったように動いてくれない」。
デフォルト設定のまま使うのと、自分好みに育てるのでは、性能が4倍近く変わる。これはHermes Agentに限った話ではなく、AIエージェント全般に言える原則です。
「AIが思ったように動かない」と感じたら、モデルのせいにする前に、まずエージェントプロファイルの厚みをチェックしてみてください。設定の手間を惜しんだ分だけ、AIは期待を裏切ります。
関連記事
Photo by Google DeepMind from Pexels





