Hermes Agent モデル比較(2026-06)

PKM運用に使うモデルをOpenRouter経由で比較した記録。

関連: Hermes-Agent

選定基準

  • 日本語が流暢
  • PKM操作用のツール操作がある程度得意
  • 思考を妨げない程度のレイテンシ
  • API料金が高すぎない

比較・検討方法

比較したモデル

Qwen 3.7 Plus

  • 日本語自然。レイテンシが長い
  • 1.60/M out

Qwen 3.6 Flash

  • たまに中国語混ざる…? 品質は悪くないが、reasoningで結構時間かかるのでPlusとあんまり変わらないように見える

DeepSeek V4 Flash

  • PKM読み書きくらいなら問題なし。レイテンシかなり短い。めちゃくちゃ安い
  • 0.20/M out

DeepSeek V4 Pro

  • 推論バランスOK。レイテンシ中くらい
  • 0.87/M out

Gemini 2.5 Flash Lite

  • 時々話聞いてない。レイテンシかなり短い

GPT 5.4 Mini

  • 精度はまあまあ。でもそこまで金出すほどかな…という感じ

Claude Sonnet 4.6

  • いつもの安定感。金があるならこれだけでいい。平気で数時間で$10使う
  • Claude Code専用。PKM操作より構成見直し・外部レビュー向き

Kimi K2.5

  • かしこい。日本語も丁度いい。バランスもいいが、やはりちょっと遅い
  • 1.90/M out

用途別の使い分け

用途モデル理由
検索DeepSeek V4 Flash安い・早い・性能そこそこで問題なし
普段のノート操作・対話DeepSeek V4 Flash重い推論必須でなければ十分
ガッツリ推論/ノート全体の深い理解Qwen 3.7 Plus / DeepSeek V4 Pro遅いけどしっかり考える。両者に大きな差は感じず
外部レビュー・構成見直しClaude Sonnet 4.6(Claude Code経由)当然賢い。ただしPKM操作不能