Hermes Agent モデル比較(2026-06)
PKM運用に使うモデルをOpenRouter経由で比較した記録。
関連: Hermes-Agent
選定基準
- 日本語が流暢
- PKM操作用のツール操作がある程度得意
- 思考を妨げない程度のレイテンシ
- API料金が高すぎない
比較・検討方法
- OpenRouterによるチャット返答の並列比較
- モデルスペック比較
- 実際のPKM操作
比較したモデル
Qwen 3.7 Plus
- 日本語自然。レイテンシが長い
- 1.60/M out
Qwen 3.6 Flash
- たまに中国語混ざる…? 品質は悪くないが、reasoningで結構時間かかるのでPlusとあんまり変わらないように見える
DeepSeek V4 Flash
- PKM読み書きくらいなら問題なし。レイテンシかなり短い。めちゃくちゃ安い
- 0.20/M out
DeepSeek V4 Pro
- 推論バランスOK。レイテンシ中くらい
- 0.87/M out
Gemini 2.5 Flash Lite
- 時々話聞いてない。レイテンシかなり短い
GPT 5.4 Mini
- 精度はまあまあ。でもそこまで金出すほどかな…という感じ
Claude Sonnet 4.6
- いつもの安定感。金があるならこれだけでいい。平気で数時間で$10使う
- Claude Code専用。PKM操作より構成見直し・外部レビュー向き
Kimi K2.5
- かしこい。日本語も丁度いい。バランスもいいが、やはりちょっと遅い
- 1.90/M out
用途別の使い分け
| 用途 | モデル | 理由 |
|---|---|---|
| 検索 | DeepSeek V4 Flash | 安い・早い・性能そこそこで問題なし |
| 普段のノート操作・対話 | DeepSeek V4 Flash | 重い推論必須でなければ十分 |
| ガッツリ推論/ノート全体の深い理解 | Qwen 3.7 Plus / DeepSeek V4 Pro | 遅いけどしっかり考える。両者に大きな差は感じず |
| 外部レビュー・構成見直し | Claude Sonnet 4.6(Claude Code経由) | 当然賢い。ただしPKM操作不能 |