Hermes Agent
-
テーマ別の関連対象抽出を独立バッチにする—探索と評価を混ぜない
Category : 実践連載最近の運用記録をもとに、テーマ候補の探索を日次評価へ詰め込むと、対象母集団と評価基準が実行中に変わるという課題…
-
予定件数・起動件数・完走件数を分ける—日次AIバッチの数字の読み方
Category : AIエージェント基礎最近の運用記録をもとに、100件体制という計画値と、実際に起動・完走・保存した件数を混ぜると障害を見逃すという…
-
JSONLログから実行セッションを監査する—評価・プローブ・再オープンを分ける
Category : 実践連載最近の運用記録をもとに、更新されたJSONLファイルをすべて新規評価として数えると、プローブや再オープンまで成…
-
1対象1セッションで大規模評価を分離する—障害範囲を小さくする設計
Category : 実践連載最近の運用記録をもとに、多数の対象を一つの長い会話で処理すると、一件の失敗が全体へ波及し再実行単位も大きくなる…
-
