Hermes Agentの「エージェントプロファイル」が重要な理由|92点 vs 27点の実証比較

「Hermes Agentって、設定次第で全然性能が違うらしい」——こういう話を聞くけど、具体的にどこがどう影響するのか、数字で示した検証結果があります。

本日紹介する動画は、「10分間セミナー」チャンネルで公開された実証レポートです。「タダシ」という名前のエージェントプロファイルと、新規に作った「エンジニア」プロファイルを比較したところ、総合スコアで92点 vs 27点という圧倒的な差が出ました。

なぜこんな差が出たのか

結論から言うと、「エージェントソウルの厚み」が原因です。エージェントソウルとは、AIの人格・スタンス・行動原則を定義する設定ファイル(SOUL.md)のこと。これが2,500文字あるかないかで、AIの振る舞いがまるで変わります。

項目 タダシ(92点) エンジニア(27点)
エージェントソウル 2,500文字 344文字(デフォルト)
ドメインスキル 69個 45個
プロジェクト固有スキル 15個 0個
ユーザーメモリー 5,000字以上 0字
モデル Gemini 2.5 Flash DeepSeek 5.5(高性能)

面白いのは、エンジニアの方が高性能なモデル(DeepSeek 5.5)を使っているのに、タダシ(Gemini 2.5 Flash)の方が仕事ができるという逆転現象が起きている点です。

人とAIは鏡のようなもの

動画では、この状況を「人材採用」に例えて説明しています。

偏差値の高い大学を出た中途入社社員(エンジニアプロファイル)が、実は文脈が読めず、忖度も効かず、「これやっておいて」と言っても全然違うことを始める。一方、中堅どころの大学出身でも、新卒から育ててきたプロパー社員(タダシ)は、背景を理解し、忖度も高く、「こういうこと分かるよね」と言えばちゃんとやってくれる。

「優秀なモデルを入れればAIは使える」わけではない。コンテキスト(文脈・背景・好み)を理解しているかどうかが、実際の性能を決める。これは人もAIも同じです。

エージェントプロファイルの4層構造

Hermes Agentの性能を決める要素は、大きく分けて4つあります。

  1. 人格定義(SOUL.md):スタンス・行動原則・ハードライン。ここが最も重要
  2. ドメインスキル:特定のタスクをこなすための手順書
  3. プロジェクト固有スキル:個別プロジェクト専用の設定
  4. ユーザーメモリー:好み・進行状況・管理情報

このうち、スキルやドメイン知識は流用できます。しかし人格定義とユーザーメモリーは、そのエージェント固有のもの。ここを育てないと、本当の「パートナー」にはなりません。

結論:魂を入れなければ、エージェントは動かない

動画の結論は明確です。「SOULがなければ、エージェントは思ったように動いてくれない」

デフォルト設定のまま使うのと、自分好みに育てるのでは、性能が4倍近く変わる。これはHermes Agentに限った話ではなく、AIエージェント全般に言える原則です。

「AIが思ったように動かない」と感じたら、モデルのせいにする前に、まずエージェントプロファイルの厚みをチェックしてみてください。設定の手間を惜しんだ分だけ、AIは期待を裏切ります。

関連記事

Photo by Google DeepMind from Pexels